岗位描述
岗位职责
1、基于开源 / 内部模型或 API,参与企业级 AI 应用研发,覆盖 RAG、Agent、工具调用、知识库问答、多轮对话、文档理解、流程自动化等方向。
2、结合业务样例与评测结果,分析模型在准确性、稳定性、召回质量、推理能力、工具调用成功率等方面的问题,定位技术瓶颈。
3、参与数据清洗、切分、Embedding、向量检索、召回排序、Prompt 策略、工具调用、后处理等全链路模块研发,提升系统效果与可解释性。
4、构建评测集与自动化评测流程,量化准确率、召回率、幻觉率、时延、成本等指标;开展 Prompt 优化、检索调优、数据增强、微调、模型对比等实验迭代。
5、协助 API 对接、服务调试、性能优化与线上问题排查,平衡效果、性能与成本;参与技术方案评审与实验设计。
岗位要求
1、应届本科或硕士,计算机 / 算法基础扎实;熟练 Python,熟悉 PyTorch、Transformers、Hugging Face 等框架。
2、理解 Transformer、大语言模型、RAG、Agent、Prompt Engineering、Embedding、模型微调等基本原理。
3、熟悉 Git、Linux、Shell、Docker,具备良好工程实践习惯。
4、具备问题定位、实验设计与数据分析能力,能通过日志、样例与评测结果分析模型效果问题。
5、对大模型应用与企业级 AI 落地有热情;有 RAG/Agent/ 微调 / NLP 等项目经验、开源贡献或高质量 GitHub 项目者优先,具备 AI-Native 工作习惯。