岗位描述
岗位职责
1.负责AI大模型(LLM、视觉、多模态)的算法研发与优化,推动前沿技术在实际场景中的应用;
2.主导大模型(包括视觉、OCR等小模型)训练、微调、压缩及部署全流程技术开发,提升模型性能和行业适配性;
3.深入制造业等垂直行业需求,设计并实现行业定制化模型解决方案,推动技术落地;
4.跟踪学术界与工业界最新技术动态,探索多模态融合、具身智能等创新方向;
5.协同产品、工程团队完成技术方案迭代与商业化交付。
任职要求
1.博士优先,计算机科学、人工智能、数学等相关专业;
2.精通大语言模型(LLM)、视觉或多模态算法开发,熟悉Transformer、Diffusion等主流架构;
3.具备大规模(LLM和多模态)分布式训练经验(如Megatron-LM、DeepSpeed),熟悉模型微调(LoRA/P-Tuning)及推理优化技术;
4.熟练掌握PyTorch/TensorFlow框架,具备扎实的算法工程化能力;
5.极强的动手能力,优秀的逻辑思维与问题解决能力,对技术落地有强烈热情。