岗位描述
工作职责:
参与Bigo大模型的研发,应用在公司海量线上内容的理解与审核,在丰富的业务场景中 (直播、短视频、图片、文字、语音),实现多种模态的大模型训练和部署。工作内容包括但不限于:
1.应用LLM/VLM/NLP/CV等能力进行风险识别和内容理解,构建内容标签体系,提升机器识别的精度和自动处理能力;
2.构建高效的数据预处理pipeline,并应用最新的大模型预训练、后训练技术,提升大模型的表征、理解和推理能力;
3.持续跟进大模型前沿技术,包括基座技术升级、高效微调、agent设计、效果评估等,并推动落地。
职位要求
1. 计算机或者相关专业硕士以上学历;
2. 熟悉大模型的训练流程和原理,了解主流的大模型后训练技术,例如SFT/DPO/GRPO/OPD等,具备丰富大模型训练经验;
3. 熟悉常用的NLP/CV/机器学习等相关技术,具备相关实践经验;
4. 具备良好的数理基础和问题分析能力,能够结合业务场景快速拆解问题、设计合理的技术方案;
5. 有成果发表在ICLR、CVPR、ICCV、ECCV、NeurIPS、ICML、TPAMI等国际顶级会议、期刊者优先。