锦鲤求职

哔哩哔哩

强化学习infra训练框架实习生

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

工作职责:
1、参与强化学习训练框架的研发与性能优化,根据业务需求持续演进训练策略与系统能力,提升大规模模型训练效率;
2、深度分析与定位训练系统中的性能瓶颈(包括计算、通信、存储等),实施针对性优化,提升训练吞吐、稳定性与可扩展性;
工作要求:
1、本科及以上学历,计算机相关专业;
2、熟悉 Python/C++ 中至少一种编程语言,具备扎实的工程基础;
3、了解自然语言处理、计算机视觉或多模态算法,了解主流的 DiT(Diffusion Transformer) 与 VLM(Vision-Language Model) 模型架构;
4、了解常见强化学习训练算法(如 GRPO、DAPO 等)及训练框架(如 verl),了解异步强化学习范式;
5、有相关领域开源项目贡献经验者优先;
6、具备大规模训练实操经验者优先。

人工智能方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →