岗位描述
1、负责计算机视觉及多模态大模型的研发、优化和应用开发工作,包括模型架构设计与优化、高质量数据集构建、模型预训练、监督微调及后训练等。
2、结合业务场景,通过Prompt Engineering、RLHF、DPO等技术手段,持续提升模型的准确性、泛化能力、推理效率、稳定性和可控性。
3、负责视觉及多模态大模型评估体系的设计与建设,全面评测模型在不同任务场景下的性能、安全性、鲁棒性及偏见问题,推动评测结果用于模型迭代和产品优化。
4、推动大模型在实际业务场景中的高效部署与应用落地,解决模型推理延迟、显存占用、计算资源消耗及部署成本等问题。
5、负责模型压缩、量化、剪枝、蒸馏、推理加速等技术的研究与应用,提升模型在云端、边缘端及终端设备上的运行效率。
6、负责大模型智能体工作流、RAG知识库及相关应用系统的设计、开发与调优,提升复杂任务处理和业务流程自动化能力。
7、持续跟踪计算机视觉、多模态大模型及人工智能领域的最新研究进展,包括算法、训练框架、推理框架和AI硬件等方向,并完成前沿技术的快速验证、原型开发及业务转化。
8、参与业务需求分析和技术方案设计,能够结合具体业务场景完成算法选型、技术验证、系统开发、部署实施及效果优化。