岗位描述
职位描述:
1、大模型功能测试:负责公司大模型(LLM)相关产品的功能测试,包括但不限于对话能力、内容生成、语义理解等核心功能的验证与评估;
2、AI 产品自动化测试:设计并开发 AI 产品的自动化测试方案和测试脚本,提升测试效率与覆盖率;
3、模型评测与基准测试:参与大模型的评测体系搭建,设计测试用例和评测基准,对模型的准确性、鲁棒性、安全性等维度进行系统化评估;
4、Prompt 工程测试:验证和优化 Prompt 设计效果,确保模型输出符合预期质量标准;
5、缺陷跟踪与质量分析:发现并跟踪 AI 相关缺陷,输出质量分析报告,推动研发团队持续优化模型表现;
6、测试工具与平台建设:参与 AI 测试工具链和测试平台的开发与维护,沉淀可复用的测试能力;
7、前沿技术研究:关注 AI/大模型测试领域的前沿技术和方法论,持续探索创新测试手段。
任职资格:
1、掌握软件测试基本理论和方法,了解测试用例设计、缺陷管理流程;
2、了解常见 AI/机器学习概念,对大语言模型(LLM)有基本认知;
3、了解 RAG(检索增强生成)、Agent、Fine-tuning 等大模型应用技术;
4、有 AI 相关项目经验、大模型使用经验或开源贡献者优先;
5、有 LLM 应用开发、Prompt Engineering 相关项目经验者优先。