锦鲤求职

阶跃星辰

Mid-train 算法研究员/工程师

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

Pre-training让模型认识世界,Mid-training让模型获得改变世界的能力。

模型经过Pre-training后能够掌握大量知识,但真正决定模型是否具备复杂任务能力的,是从基础模型到智能模型之间的能力塑造过程。Mid-training正成为连接Foundation Model与Reasoning、Agent时代的重要阶段。

你将负责探索:

如何让模型在已有知识基础上持续获得代码、数学、Reasoning、Agent、多模态等高级能力;

如何避免持续训练过程中模型能力遗忘,实现稳定的能力增长;

如何设计有效的训练Recipe,让模型能力从Scaling走向Capability Emergence

如何利用课程学习、持续学习、自蒸馏、Synthetic Data等方法提升训练效率

如何建立从数据构造、训练实验到能力评估的完整能力增长闭环

这里的问题不是让模型学更多,而是让模型学会更复杂的事情。

岗位职责

负责大语言模型 Mid-training 阶段算法研究,探索模型能力持续增强的方法与训练范式。

围绕代码、数学、Reasoning、Long Context、Agent、多模态等方向设计训练方案,提升模型复杂任务解决能力。

研究 Curriculum Learning、Continual Learning、Self-training、Knowledge Injection 等训练方法,并通过大规模实验验证有效性。

分析模型能力变化规律,定位能力提升与退化原因,建立系统化的模型能力迭代方法。

与Pre-train、Post-train、Evaluation、Infra团队协作,打通从基础模型到高级能力模型的完整训练链路。

任职要求

从内心深处认可数据的价值

2026 届或 2027 届计算机、人工智能、数学、电子、自动化等相关专业硕士及以上或优秀本科生;

熟悉大语言模型训练流程,理解Transformer架构、预训练及后训练基本方法。

具备较强实验设计能力,能够独立完成训练实验、数据分析和模型能力评估。

对Reasoning、Code Model、Long Context、Agent、多模态训练等方向有深入理解或实践经验者优先。

在各类竞赛中取得突出成绩,或在开源社区有重要贡献者优先。

人工智能方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →