岗位描述
岗位职责
岗位职责
1、AI语音业务测试:负责语音识别(ASR)、语音合成(TTS)、语音唤醒、连续对话、降噪适配、方言/场景化语音交互等核心功能测试,验证语音识别准确率、合成流畅度、唤醒灵敏度、断句效果、嘈杂环境适配性等核心指标。
2、LLM大模型功能测试:负责大模型对话机器人、智能问答、内容生成、多轮对话、上下文记忆、意图识别、知识库问答、指令遵循等核心业务测试,覆盖闲聊、业务问答、指令执行、内容创作、多模态联动等全场景测试。
3、测试方案与用例设计:结合AI产品特性,梳理复杂业务场景,独立编写AI专项测试方案、场景化测试用例,重点覆盖边界场景、异常输入、歧义语句、违禁内容、低概率真实用户场景,保障测试覆盖全面性。
4、模型效果评测与质量把控:针对LLM输出的准确性、逻辑性、一致性、相关性、无害性、客观性进行人工评测,识别模型幻觉、答非所问、逻辑混乱、重复冗余、违禁生成、上下文丢失等各类模型问题,精准定位问题并分类定级。
5、问题跟进与闭环管理:独立提交、跟进模型缺陷与业务问题,对接算法、产品、研发团队,精准描述问题复现步骤、场景及问题现象,协助定位根因(算法模型问题/业务逻辑问题/交互问题),推动问题迭代修复与回归验证。
6、测试沉淀与优化:持续积累AI语音、大模型测试经验,沉淀典型问题库、测试场景库、评测标准,协助优化测试流程、完善AI质量评测规范,提升整体测试效率与产品质量。
7、迭代版本测试交付:跟进产品迭代节奏,完成日常版本测试、灰度测试、回归测试、专项评测,按时输出测试结论、质量评测报告,保障版本稳定交付。
任职要求
1、2年及以上AI测试、大模型测试、语音交互测试相关经验,有生成式LLM产品、智能客服、语音助手、AI对话产品测试经验者优先,接受外包驻场模式。
2、深刻理解LLM大模型核心特性,熟悉大模型常见问题:幻觉、上下文遗忘、意图识别错误、知识时效性错误、逻辑矛盾、内容违规等,具备成熟的模型评测思维。
3、熟悉AI语音测试核心指标与场景,了解ASR语音识别、TTS语音合成基础原理,能够针对不同环境、不同话术、不同口音场景开展专项测试。
4、具备优秀的场景化测试思维,擅长挖掘边缘场景、异常用户输入、复杂多轮对话场景,细心严谨,对模型输出质量、语义细节敏感度高。
5、熟练使用禅道、Jira等常规测试管理工具,能够独立完成用例编写、缺陷提交、测试报告输出,规范完成测试交付工作。