岗位描述
岗位职责:
1.负责大语言模型、多模态大模型的训练与后训练算法研发,包括 SFT、强化学习、模型评测及效果优化;
2.负责大模型智能体算法研发,研究 RAG、工具调用、MCP、任务规划、记忆与多智能体协同等技术;
3.参与模型轻量化、推理加速及端侧部署优化,推动大模型在金融、医疗、城市智能、机器人等场景落地;
4.跟踪大模型与智能体领域前沿进展,开展技术预研、算法验证及工程化应用。
岗位要求:
1.计算机、人工智能、自动化等相关专业硕士及以上学历,具备扎实的机器学习、深度学习基础;
2.熟悉 Transformer 及大模型基本原理,了解模型训练、SFT、强化学习、Agent 等相关技术;
3.熟练掌握 Python,熟悉 Linux 开发环境及 PyTorch 等主流深度学习框架;
4.对大模型技术具有强烈兴趣,具备良好的逻辑思维、算法实践、学习探索及团队协作能力;
5.有大模型、多模态、Agent、模型压缩或推理优化相关科研、竞赛或项目经历者优先。