锦鲤求职

智谱AI

GLM-强化学习训练框架工程师(RL)

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

职位描述

负责强化学习训练框架的研发、优化和维护,根据业务需求持续改进训练框架和策略,提升模型训练效率

分析和定位训练中的性能瓶颈,实施针对性优化措施,提升训练效率和稳定性

跟进业界技术进展,不断同步与集成最新训练优化策略

职位要求

对自然语言处理、计算机视觉和多模态算法有深入理解,熟悉主流的 LLM 模型架构,有分布式训练经验

对常见 RL 训练算法有基本了解

熟悉 vllm 或 sglang 等常用开源推理框架的优先考虑

后端开发方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →