岗位描述
岗位职责
1. 汽车以及机器人视觉感知能力建设,结合马赫芯片研发高速、高性能视觉编码器,提升空间感知、深度信息、语言理解和推理能力,支撑自动驾驶感知能力提升;
2. 研究视觉预训练、后训练、强化学习、模型蒸馏、裁剪量化方案,在理想自动驾驶、机器人交互业务场景落地。
岗位要求
1. 硕士及以上学历,自动化、计算机等相关专业;
2. 必须有视觉VIT基座优化经验或者VLM、VLA相关项目落地交付经验;
3. 优秀的代码技术功底,熟练掌握模型强化学习技术、多模态大模型模型蒸馏、视觉Token压缩、空间感知增强等技术中的一种。
具备以下条件优先:
1. 在NeurlPS/ICLR/ACL/EMNLP/CVPR/ICCV等会议或期刊上发表过论文者优先;
2. 获得过国际或国内重要赛事奖项者优先;
3. 在大模型领域有主导过有影响力项目或者核心技术发布者优先。
视觉大模型VLM、视觉编码器方向研发及实习经验为佳