岗位描述
岗位描述
1. 探索多模态大模型的高效训练,包括预训练、SFT、及RLHF等技术;
2. 探索高效的视觉编码器结构、对齐范式、训练策略、数据清洗、质量分级、数据合成等;
3. 探索原生多模态大模型的架构与训练范式;
4. 探索图像、视频、音频的全模态大模型;
5. 结合淘天业务,推动多模态大模型在搜索、推荐、广告等业务中的应用。
岗位要求
1.计算机视觉、自然语言处理、语音处理、机器学习、数据挖掘、人工智能等相关专业的硕士或博士;
2.具备较好的编程能力,动手能力强,熟练使用至少一种开源深度学习框架;
3.优秀的英文文献阅读能力,有人工智能顶会顶刊论文发表者优先,ACM竞赛获奖者优先。