锦鲤求职

商汤科技

【27届校招】多模态理解生成一体研究员-视频生成与创作研发

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

岗位职责
1、多模态理解与生成算法研究: 紧跟领域前沿,深入研究多模态(图像、文本、视频)的理解与生成统一的核心算法;
2、 模型设计与优化: 负责多模态理解与生成模型的设计、训练、评估和优化,不断提升模型性能和泛化能力;
3、创新技术探索: 探索新的预训练和后训练范式,发现和解决大模型靠单一模态难以解决的问题。

岗位要求
1、2027届本科及以上学历,计算机、软件工程、人工智能等相关专业 ;
2、 熟悉理解生成一体化模型的常用做法和进展,了解Bagel, Tuna, SenseNova-U1等模型,有实际项目经验或顶会论文;
3、对自回归和扩散模型均有一定了解,熟悉多模态理解模型(如Qwen系列,Intern系列等)或图像生成模型(如FLUX/Qwen-Image/Z-Image等)或视频生成模型(如Wan等);
4、熟悉RL的相关知识,有相理解生成的UnifiedRL相关研究或训练经验更佳;
5、 扎实的编程和数学知识,快速学习的能力。

人工智能方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →