岗位描述
职位描述
负责强化学习训练框架的研发、优化和维护,根据业务需求持续改进训练框架和策略,提升模型训练效率
分析和定位训练中的性能瓶颈,实施针对性优化措施,提升训练效率和稳定性
跟进业界技术进展,不断同步与集成最新训练优化策略
职位要求
对自然语言处理、计算机视觉和多模态算法有深入理解,熟悉主流的 LLM 模型架构,有分布式训练经验
对常见 RL 训练算法有基本了解
熟悉 vllm 或 sglang 等常用开源推理框架的优先考虑
锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。
职位描述
负责强化学习训练框架的研发、优化和维护,根据业务需求持续改进训练框架和策略,提升模型训练效率
分析和定位训练中的性能瓶颈,实施针对性优化措施,提升训练效率和稳定性
跟进业界技术进展,不断同步与集成最新训练优化策略
职位要求
对自然语言处理、计算机视觉和多模态算法有深入理解,熟悉主流的 LLM 模型架构,有分布式训练经验
对常见 RL 训练算法有基本了解
熟悉 vllm 或 sglang 等常用开源推理框架的优先考虑
先核对岗位要求与自己的经历,再准备档案、投递和面试。