岗位描述
岗位职责:
1. 基于深度学习、计算机视觉及多模态技术,开展工业、仓储、物流、机器人及自动驾驶等场景的感知与智能算法研发;
2. 负责目标检测、分割、定位、跟踪、3D感知等算法的研发、训练与优化,提升算法效果及场景适应能力;
3. 参与视觉、语言、空间信息及多传感器融合,探索场景理解、导航决策及智能行为生成等技术;
4. 跟踪计算机视觉、自动驾驶、机器人、具身智能及多模态等前沿技术,开展技术预研。
岗位要求:
1. 2027届应届毕业生,计算机、人工智能、自动化、机器人等相关专业硕士及以上学历;
2. 熟练掌握 C++、Python 等一种或多种编程语言,具备扎实的算法与数据结构基础;
3. 熟悉 PyTorch 等深度学习框架,具备扎实的计算机视觉基础;
4. 了解目标检测、分割、跟踪、3D感知、多模态等相关算法,了解 Transformer 等主流模型架构;
5. 了解 VLM/VLA 等视觉语言及视觉-语言-动作模型,熟悉模仿学习、强化学习或策略学习等相关方法;
6. 熟悉 Linux、Git 等开发工具,具备较强的工程实践和问题分析能力;
7. 能够合理使用 AI 工具辅助开发、调研及问题分析,并具备独立验证能力。
优先考虑:
1. 深入理解 Transformer 架构,了解端到端 VLA 大模型(如 RT 系列、OpenVLA 等),掌握模仿学习或强化学习基本原理;
2. 具有自动驾驶、机器人、AGV/AMR、无人叉车等项目经验,熟悉感知、定位、规划或多传感器融合;
3. 具备较强的 C++ 工程能力,熟悉现代 C++、多线程及性能优化;
4. 熟悉 OpenCV、PCL 等视觉及点云处理工具;
5. 具有 ONNX、TensorRT、CUDA、Jetson 等模型部署及优化经验;
6. 在 CVPR、ICCV、ECCV、ICRA、IROS、CoRL 等会议发表论文,或具有 ACM/ICPC 等竞赛经历。