锦鲤求职

元戎启行

【2027秋招】AI Infra工程师

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

【你将参与什么】

大模型(VLA/World Model/Foundation Model等)的分布式训练和车端芯片部署,是当今 AI 工程化最困难的问题之一。你将参与构建支撑“端到端”智驾的大模型底座,在有限算力与显存约束下,压榨出极致性能。如果你对分布式训练并行策略、GPU 原语、Transformer 推理加速和编译器后端着迷,这里是个理想的实践场。

【你的工作内容】

1. 大模型训练加速:协助开发大规模分布式训练框架,RL训练框架,探索混合精度训练(FP8/BF16),解决千卡集群下的通信瓶颈与 MFU 优化等问题。

2. 训练数据吞吐引擎:针对智驾所需的视频流数据,优化高性能数据加载器(DataLoader)与分布式缓存系统,提升多模态数据的 IO 效率。

3. 模型量化和部署:参与推理引擎与高性能算子的设计与优化,参与模型结构优化(剪枝、蒸馏)及量化工具开发,帮助大模型“减肥上车”并确保精度闭环。

【对你的期待】

1. 计算机相关专业,熟练掌握 C++/Python,具备扎实的计算机体系结构知识。

2. 对深度学习框架底层有好奇,熟悉 Transformer 架构,有 CUDA/Triton 经验或 ACM 竞赛经历者优先。

3. 有分布式训练(Megatron/DeepSpeed)、推理加速(vLLM/TensorRT-LLM)或模型量化经验者优先。

运维/技术支持方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →