岗位描述
1. 参与 AI 应用需求评审,制定 AI 软件测试方案,设计功能、边界、对抗测试用例;
2. 开展应用功能、接口及大模型效果评测,评估模型幻觉、准确性、内容安全等指标,输出评测报告;
3. 负责缺陷提交、跟踪、回归验证,推动问题闭环;
4. 参与数据集质量检查,沉淀 Prompt 评测集;
5. 使用 Python 编写简单自动化脚本,搭建批量评测任务;
6. 协同产品、算法、研发识别质量风险,持续优化产品质量。
任职要求:
1.计算机、人工智能、软件工程、自动化等相关专业;
2. 掌握软件测试基础理论,了解接口测试,熟悉 Python;
3. 了解大模型、机器学习基础概念优先;
4. 具备良好逻辑思维,善于挖掘边界场景;
5. 工作细致,沟通良好,有较强学习能力。