岗位描述
岗位职责
1.参与大规模预训练模型(LLM、多模态等)的研究、优化及落地应用,包括但不限于模型预训练、后训练、对齐、端侧部署等;
2.基于大模型技术,构建新一代Agent产品;
3.跟进学术界与工业界前沿技术,推动技术迭代与产品创新。
岗位要求
1.硕士及以上学历(3年以上相关工作经验),计算机、人工智能、自动控制等相关专业背景;
2. 熟练掌握深度学习、自然语言处理、计算机视觉等基础知识,掌握pytorch,mindspore等AI框架;
3. 熟练掌握大模型增量预训练, 后训练,对齐等训练方法,能够独立开展相关模型训练优化工作;
4. 掌握大模型的应用方式, 包括RAG,WorkFlow、Agent 等方面,有成功大模型应用经验和前后端开发经验优先
5. 扎实的代码功底和工程开发能力,Python、Java、C++ 等编程语言均可,有算法国产端侧芯片部署经验优先;
6. 有强烈的责任心和团队合作精神,思路清晰、较好的沟通能力与技术学习能力。
7. 有发表相关技术成果或相关学术论文的优先。