锦鲤求职

阶跃星辰

AI 模型数据分析师

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

岗位职责

1. 负责训练数据(预训练/SFT/RLHF)的清洗、去重、去污染与标注质检;

2. 基于模型评测结果与 bad case 进行数据归因分析,追溯至数据层面根因,输出可验证的修复方案并推动落实;

3. 负责评测基准(Benchmark)的构建与维护,严格控制评测集的版本管理与数据泄漏风险;

4. 深入分析数据分布特征与潜在质量问题,建立质量监控指标并持续跟踪改进效果;

5. 持续优化数据生产与质检流程,追求更高的数据质量上限与效率上限。

任职要求(须同时满足)

1. 本科及以上学历,3 年以上数据分析经验,其中不少于 1 年大模型/AI 数据相关经验;

2. 对 LLM 训练全流程(预训练/SFT/RLHF)的数据需求有深入且基于实践的理解;

3. 精通 SQL,熟练使用 Python 进行大规模数据处理与分析;

4. 具备极强的数据敏感度与逻辑归因能力,能够从海量数据中识别细微异常并定位根源;

5. 具备高度的主动性与 ownership,能够独立发现问题、定义问题并推动闭环解决。

优先考虑

• 有训练数据集或 Benchmark 评测集构建经验;

• 有数据去污染、质检体系或数据治理体系建设经验;

• 有大模型辅助标注/质检的实际落地经验并取得可量化效果。

数据方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →