岗位描述
职位简介:
大疆正在让各产品线智能硬件真正"看懂"三维物理世界,从空间几何与语义统一基础模型的预训练与后训练,到下游感知、定位、规划任务的全面适配,再到端侧、边侧、云端三层架构下的轻量化部署与持续闭环,我们具备完整技术栈。我们寻找对空间智能与物理 AI 抱有同样信念的同路人,与我们一起,把"看一眼就读懂三维世界"的能力,从前沿论文带到亿级真实设备。
工作职责:
1. 负责面向真实物理世界的空间几何与语义统一基础模型的预训练、后训练及持续迭代;
2. 负责多模态视觉/几何/语义下游任务的适配、评测与数据策略设计;
3. 负责基础模型在端侧、边侧、云端的接口设计与下游应用对接;
4. 跟进 3D 视觉基础模型方向的最新进展,推动新范式在飞行机器人场景的落地。
任职要求:
基本要求:
1. 计算机、电子、自动化、数学、物理等相关专业,硕士及以上学历;
2. 扎实的深度学习与三维视觉基础,熟练 PyTorch/CUDA,具备大规模模型训练或分布式训练经验;
3. 在 3D 视觉基础模型方向至少一个分支(DUSt3R/MASt3R/VGGT/Spann3R、3DGS/NeRF、Occupancy/BEV 等)有深入实践,能阅读并复现近一年顶会工作;
4. 良好的工程能力与代码规范,能独立完成从数据到模型到评测的完整闭环。
加分项:
1. CVPR/ICCV/ECCV/ICLR/NeurIPS/SIGGRAPH 等顶会一作论文;
2. 有大规模视觉或多模态基础模型(十亿级以上参数)预训练或后训练实战经验;
3. 有开源项目核心贡献,或 Kaggle/国际比赛 Top 名次;
4. 对空间智能、具身智能、世界模型方向有自己的判断与代表性作品。