岗位描述
岗位职责
岗位职责:
1、负责自动驾驶视觉-语言-动作多模态模型与世界模型联合研发,依托大模型、生成式时序建模能力,实现交通场景理解、时空推演、智能决策闭环。
2、参与自动驾驶多模态、时序场景数据集的清洗、对齐与优化,完善场景数据体系,支撑模型训练与迭代。
3、开展自动驾驶世界模型研发,实现交通场景重建、参与者行为预测、长时序场景推演,优化场景泛化与推演精度。
4、探索VLA与世界模型协同推理、联合训练方案,完成消融实验与效果复盘,输出技术文档,跟进前沿技术落地应用。
岗位要求
任职要求:
1,硕士及以上在读或者,计算机、人工智能、计算机视觉、自动化等相关专业,稳定实习6个月以上优先。
2,扎实的深度学习基础,熟悉Transformer、扩散模型。
3,了解自动驾驶基础场景与决策逻辑,有VLA、世界模型、视频生成、场景建模相关项目经验者优先。
4,发表过CVPR/ICCV/ECCV/ICRA/IROS/RA-L等相关会议或者期刊或者在自动驾驶相关竞赛中或者名次。