岗位描述
岗位职责
1. 参与图像/视频生成基础大模型的研发,负责模型架构设计、预训练、后训练及算法优化;
2. 参与训练体系建设,包含数据管道、数据质量优化,及评测体系建设,提升数据质量,指导模型训练;
3. 参与大规模生成模型预训练infra的建设,持续优化模型训练与推理效率,支持模型规模化部署;
4. 跟踪AIGC与多模态大模型前沿技术与研究成果,推动新算法、新技术的落地应用。
任职要求
1. 2027届应届毕业生,计算机、人工智能、数学等相关专业,硕士及以上学历;
2. 具有扎实的机器学习、深度学习基础,熟悉 Transformer、Diffusion、Flow Matching、Autoregressive等模型架构;
3. 熟练使用Python,掌握PyTorch等深度学习框架;
4. 具备良好的算法实现、问题分析和科研探索能力,勇于接受有挑战性的工作;
5. 对图像生成、视频生成、多模态大模型等方向有科研或项目经验,具备良好的学习能力和团队合作能力。
加分项
1. 有图像/视频生成大模型预训练或后训练相关项目或科研经历;
2. 熟悉视频 Tokenizer、长视频建模、强化学习、LoRA、模型蒸馏、Agent等相关技术;
3. 有大规模模型训练优化(训练加速、显存优化、推理加速等)经验;
4. 在顶级会议发表论文或有高质量开源项目、算法竞赛经历。