岗位描述
岗位职责
工作职责
多模态大模型研究: 跟进多模态大模型领域前沿,开展图像、文本、视频等多模态内容理解、推理与生成相关算法研究。
模型训练与优化: 参与多模态大模型的预训练、后训练、评估及优化,研究数据构建、指令微调、偏好对齐等关键技术,持续提升模型的理解、推理和泛化能力。
创新方向探索: 探索多模态统一建模、视觉推理、视频理解与生成等前沿方向,发现并解决单一模态模型难以处理的复杂问题。
研究成果沉淀: 参与前沿论文复现、技术方案验证及实验分析,推动研究成果形成论文、专利或可落地的技术能力。
岗位要求
任职要求
扎实的专业基础: 计算机科学、人工智能、电子工程、自动化等相关专业在读本科高年级学生、硕士或博士生,对机器学习、深度学习及多模态学习有较深入的理解。
良好的算法与工程能力: 熟悉 Transformer、视觉语言模型等核心模型,熟练使用 Python 及 PyTorch 等深度学习框架,具备模型训练、调试和实验分析能力。
强烈的研究兴趣: 对多模态大模型前沿技术具有浓厚兴趣,能够主动阅读论文、复现方法,并独立分析和解决研究问题。
优秀的自驱与协作能力: 具备较强的学习能力、自驱力和执行力,拥有良好的沟通能力及团队协作精神。
AI 工具使用能力: 熟悉常见 AI 编程工具,如 Claude Code、Cursor、GitHub Copilot 等,能够将其有效融入代码编写、调试和研究工作流。
加分项
在多模态理解、视觉语言模型、视频理解或生成等方向有相关研究经历。
在相关领域会议或期刊发表过论文,或有高质量开源项目、竞赛成果。
具备大模型预训练、后训练、数据构建或分布式训练经验。