岗位描述
岗位职责
参与AI模型与算法的研发,包括数据处理、特征工程、模型设计、训练调优、评估迭代与上线落地;
跟踪大模型、多模态、生成式AI等前沿技术,参与预训练、微调、RLHF、RAG、Agent等相关工作;
负责模型工程化与部署,参与训练/推理Pipeline搭建、分布式训练、模型压缩、量化、蒸馏及服务化;
与产品、业务、工程团队协作,将AI能力落地到具体业务场景,参与A/B测试、效果监控与持续优化;
参与AI平台与工具链建设,提升模型训练、推理和迭代效率;
撰写技术文档、专利或论文,参与团队技术分享与知识沉淀。
任职要求
27届应届硕士及以上学历,计算机、人工智能、软件工程、数学、统计学、自动化、电子工程、模式识别等相关专业优先;
扎实的机器学习与深度学习基础,熟悉常见网络结构、优化方法、损失函数与评估指标;
熟练使用 Python,熟悉 PyTorch / TensorFlow 等至少一种深度学习框架;
熟悉 Transformer、LLM、CV、NLP、推荐搜索、多模态等至少一个方向,有实际项目、论文、竞赛或开源经历;
具备良好的编程能力与数据结构/算法基础,代码规范,熟悉 Linux、Git、Docker 等常用工具;
了解分布式训练、CUDA、模型推理优化、向量数据库、LangChain/LlamaIndex 等技术者优先;
英语 CET-6 及以上优先,能够阅读英文论文与技术文档;
自驱力强,学习能力强,具备良好的团队协作与沟通能力。