岗位描述
职位简介:
大疆正在为各产品线智能硬件的作业场景构建"可控生成式数字孪生"——以海量真实作业片段为原料,从大规模 3DGS / 4DGS 重建、可控视频生成、场景编辑,到 log2world 训练闭环与强化学习仿真,我们具备完整技术栈。我们寻找相信"世界模型是数据飞轮底层引擎"的同路人,与我们一起,把真实物理世界以可生成、可分支、可重放的方式带入训练循环,让世界模型成为新一代具身智能的"梦境引擎"。
工作职责:
1. 负责基于多视图/时序传感器的大规模 3D/4D 场景重建与新视角合成算法研发;
2. 负责可控视频生成与场景编辑算法,支撑长尾场景仿真与真实数据的可控扩展;
3. 负责仿真平台与训练链路的算法侧集成,支撑数据合成与强化学习训练闭环;
4. 跟进世界模型/神经渲染/生成式仿真方向的前沿进展并在业务中落地。
任职要求:
基本要求
1. 计算机、电子、自动化、图形学等相关专业,硕士及以上学历;
2. 扎实的三维视觉、神经渲染或生成模型基础,熟练 PyTorch/CUDA;
3. 在以下方向至少一项有深入实践:3DGS/4DGS/NeRF/神经隐式表征、Diffusion/视频生成、可控生成与场景编辑、Driving/Embodied World Model;
4. 具备大规模数据处理与训练能力,能独立完成“重建-生成-评测”链路。
加分项
1. SIGGRAPH/CVPR/ICCV/ECCV/NeurIPS/ICLR 等顶会一作论文;
2. 复现或主导过 Sora/Cosmos/GAIA/DriveDreamer/Vista/WorldDreamer/Genie 等世界模型类工作;
3. 熟悉 Nerfstudio/gsplat/Threestudio/Diffusers 等开源框架并有核心贡献;
4. 有真实机器人、自动驾驶或无人机数据的 log2world、sim-to-real 实战经验。