岗位描述
岗位职责
1.负责制造场景(如装配、质检)的视觉/多模态大模型的研发、训练和迭代;
2.负责通用视频理解(如动作识别、行为分析、物料识别)的技术路线设计;
3.负责进行模型微调、推理加速和性能优化,确保模型在实际场景中的高效与鲁棒性。
岗位要求
1.博士学历,计算机、软件工程、电子信息等相关专业;
2.具备丰富的视觉模型、多模态大模型研发经验,有从0到1的落地项目经历;
3.精通大模型训练、SFT、RLHF、LoRA等微调技术,并有实际的推理加速(如量化、剪枝)经验;
4.在顶会/顶刊论文 (如CVPR/AAAI/KDD/NIPS/ICLR/等)发表论文者或国际比赛获奖者优先;
5.有较好的沟通能力、团队协作能力,积极主动,愿意接受挑战。