岗位描述
岗位职责
1. 参与视觉大模型开发、微调与轻量化改造,适配机器人相机、端侧嵌入式芯片;
2. 负责机器人场景视觉数据集清洗、标注、图文配对构建,配合完成SFT模型微调、数据迭代优化;
3. 协助优化三维视觉、目标检测、语义分割、跨场景目标识别算法,适配居家、商用复杂真实场景;
4. 协助完成模型量化、蒸馏、算子优化与机器人端侧部署、真机调试;
5. 跟进视觉大模型SOTA技术,完成技术调研、文档输出,配合跨部门完成算法联调。
岗位要求
1. 硕士及以上应届生,扎实深度学习、计算机视觉理论基础;
2. 熟练Python、PyTorch框架,了解主流VLA视觉大模型、视觉基础模型原理;
3. 掌握计算机视觉基础算法、多模态融合基础理论,了解数据集构建、模型微调流程;
4. 熟悉ONNX、TensorRT部署工具、ROS/ROS2、C++基础;
5. 逻辑清晰、执行力强,具备独立算法复现、实验调试能力。
加分项
- 有视觉大模型、多模态、机器人视觉科研/实习项目经历;
- CVPR/ICCV/ECCV顶会论文、开源视觉项目贡献者;
- 熟悉三维视觉、6DoF位姿估计、机器人具身智能方向;
- 有机器人算法、端侧模型部署实习经验。