岗位描述
岗位职责
1、大规模图文数据挖掘、整理、生成等工作
2、多模态大模型的训练和调优
3、模型部署与压缩
岗位要求
1、深入理解Transformer、注意力机制、自监督学习等核心原理,能进行算法创新与改进
2、熟悉CLIP、LLaVA、MiniGPT-4、Qwen-VL、InternVL、GLM等主流多模态大模型架构
3、有多模态大模型全流程训练经验(数据构建→预训练→微调→评估)
4、有视觉问答/图文检索/多模态对话等至少一个方向的落地经验
5、有大规模多模态数据挖掘、清洗与治理经验
6、精通Python/PyTorch,具备从研究到生产的全链路工程化能力