岗位描述
岗位职责
1、负责模型从下载、转换、量化、部署、验收至上线的完整流程。
2、建立模型部署矩阵,覆盖模型、硬件、量化方式、推理引擎和并行策略。
3、 建立 Golden Set、保真度、性能、稳定性和协议兼容测试体系。
4、负责模型输出质量、工具调用、多轮对话、思考模式和多模态能力测试。
5、对比不同引擎、不同量化方案和不同硬件配置的实际效果。
6、维护模型上线门禁、版本回归和上线报告。
7、跟踪模型版本更新,组织重新评测和生产配方更新。
8、完成领导交办的相关工作。
岗位要求
1、2 年以上大模型部署、模型评测、算法工程或 AI 平台经验。
2、熟悉 Hugging Face、模型权重转换、量化和推理服务部署。
3、熟悉 vLLM、SGLang 或 TensorRT-LLM 至少一项。
4、熟悉吞吐、TTFT、TPOT、并发、显存和错误率等指标。
5、能使用 Python 编写自动化评测和数据分析工具。
6、具备较强的问题复现、测试设计和报告能力。
7、优先条件
有 DeepSeek、GLM、Qwen、Kimi、MiniMax 等模型测试经验。
有 Coding Agent、工具调用、多轮对话或多模态模型测评经验。
有模型保真门、Golden Set 或生产上线门禁建设经验。