岗位描述
岗位职责
【职位描述】
工作内容:
1. 研发与优化视觉-语言行动模型(VLA)和世界动作模型(WAM),结合视觉、语言、动作、触觉等模态,实现机器人多模态感知与控制。
2. 数据处理、训练以及推理部署VLA/WAM模型,确保模型的高效性与准确性。
3. 探索最新的 VLA/WAM 研究方向,推动模型在具身智能领域的应用。
4. 开发高效的数据驱动训练框架,提升模型在物理环境中的泛化能力与稳定性。
5. 系统集成与部署,将 VLA/WAM 算法应用到具身智能平台,如机器人操作平台系统等。
岗位要求
【岗位要求】
1. 硕士及以上学历,计算机科学、人工智能、自动化、机器人等相关专业。
2. 精通 Python,熟悉至少一种深度学习训练框架。
3. 具备多模态大模型(Transformer-based)训练与优化经验,包括 VLA/WAM 相关架构。
4. 深入理解 Transformer、Diffusion Model 等模型,具备大模型训练与微调经验。
5. 熟练使用AI Agent加速本职工作的推进。
6. 有 VLA/WAM 相关落地项目经验者优先。
7. 熟悉主流机器人仿真平台(如 Isaac Sim)者优先。