岗位描述
一、岗位职责
1. 设计LLM/Agents的训练和对齐路线:面向长思维链推理,任务分解,目标寻优,工具使用的行为学习和对齐(SFT、偏好学习、RL、离线数据驱动等);
2. 设计训练数据与评测:轨迹数据采集、标注与合成;
3. 将 LLM/大模型 mid-training 与 post-training 引入科学模型:领域适配继续训练、指令微调、偏好优化/对齐、工具使用与评测流程,使模型更适合科学任务。
二、招聘要求
1. 要求硕士及以上学历;
2. 计算机,人工智能,数学,数据科学等专业背景;
3. 有LLM/Agent领域SCI二区及以上期刊发表优先;
4. 至少一种编程语言,如python/C++编程经验,或vibe coding完成完整项目的优先;
5. 对科研热点跟踪,学术论文复现能力强的优先。