锦鲤求职

哈啰出行

一段式端到端强化学习算法高级专家/负责人-【自动驾驶】(J21747)

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

岗位职责
1、在一段式端到端模型完成模仿学习训练后,针对安全防护、多智能体博弈、居中性等任务,通过强化学习进行后训练迭代优化;
2、负责RL算法体系搭建与迭代,带领小组完成模型训练、模型评测、实车落地全流程;
3、沉淀技术成果,推动团队技术标准化、体系化建设。

岗位要求
1、本科及以上学历,2年以上自动驾驶模仿学习、强化学习落地经验;
2、主导过RL算法从框架设计选型、模型训练到实车落地的全过程,熟悉OpenRLHF、FM GRPO等框架;
3、熟悉一段式端到端模型的常见结构,有一段式端到端模型落地经验;
4、熟悉常见RL的Reward设计方案,对各类reward可能会带来的问题、避免其他场景退化等方面有处理经验;
5、有头部智驾公司核心项目经验、顶会论文或知名开源项目者优先。

团队福利:
完整L4落地场景+海量真实数据+万卡算力支持、算法快速上车验证、技术氛围纯粹、弹性工作制、完善薪酬期权体系。

人工智能方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →