锦鲤求职

蚂蚁集团

蚂蚁数字科技-数科技术部-大模型强化学习研发专家

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

岗位描述
1.负责实时高性能强化学习框架的设计与开发,服务蚂蚁数科的模型训练场景,如分布式训练加速策略、显存管理、算子融合、编译优化、模型量化、混合精度、异构硬件加速等;
2.与算法工程师深度合作,针对大模型强化学习训练和推理场景,进行端到端性能分析和优化,包括分布式训练加速、显存优化、通信效率提升等,满足大规模 Agent 训练的性能要求。

岗位要求
1.具备大模型训练框架或分布式推理框架开发经验,熟悉 Megatron-LM、DeepSpeed 等分布式训练框架,或具备 SGLang、vLLM 等大模型分布式推理与推理加速框架开发经验者优先;
2.具备大模型强化学习框架相关经验者优先,例如 AReaL、veRL、Slime 等, 对RL流程熟悉者优先;
3.具备良好的逻辑分析能力,对复杂框架的模块设计、抽象边界和工程实现有一定理解,热爱技术且对强化学习领域有深入钻研优先;
4.熟悉 Agent 工程或 AI Coding Agent 工具链者优先;
5.有大模型训练经验优先。

后端开发方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →