岗位描述
岗位职责
负责基于大模型搭建企业 AI 应用、知识库问答、RAG 检索增强、Agent 智能工作流等功能开发落地;
完成提示词工程、模型效果评估、输出稳定性优化,解决幻觉、回答不准确等问题;
使用 LangChain、Dify、Llama‑Index 等框架,对接 OpenAI / 通义千问 / 文心一言等大模型 API;
设计向量知识库,对接向量数据库,搭建文档解析、切片、向量化检索全链路;
与产品、业务团队沟通,将业务需求拆解为可落地的 AI 技术方案;
AI 应用上线部署、运维监控、迭代优化,保障生产环境稳定运行。
搭建高可用企业级 RAG、Agent 系统,解决生产环境的延迟、成本、幻觉等难点;
评估开源大模型,开展本地化部署、模型微调、性能优化;
任职要求
必备条件
本科及以上,计算机、软件工程等相关专业;
熟练使用 Python 开发,了解接口开发、API 调试;
有 RAG、大模型应用、知识库项目落地实战经验;
了解 Embedding、向量检索、Prompt 优化、Agent 工具调用;
具备问题排查能力,能够定位大模型应用效果问题。
优先条件
熟悉 Docker、后端部署、Linux 基础命令;
有微调(LoRA)、模型私有化部署经验;
熟悉向量数据库:Chroma、Milvus、FAISS、Pinecone;
有企业 Copilot、智能客服、文档分析项目经验。
具有生物行业经验者优先