锦鲤求职

理想汽车

AI服务器系统架构高级专家

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

岗位职责
1. AI数据中心与服务器总体架构设计
- 负责AI服务器硬件与系统架构的总体规划与定制化方案设计。
- 结合 AI计算架构、通信架构设计,在满足大模型训练与推理的性能、可靠性要求前提下,实现成本最优导向。
- 具备强大的工程化能力,能够独立做出定制化的系统方案,并强力推动方案在业务场景中的最终落地。
2. 前瞻技术定义与路线规划
- 紧跟2026年及未来数据中心最新发展方向,深入研究并跟踪业界前沿AI超节点架构(如NVL72, B200/B300, 阿里磐久, 华为ub-mesh 384, Google TPU v6/7/8/9等)的发展脉络。
- 结合公司业务需求,提前定义服务器技术路线,主导重大技术选型、新技术评估(算法、芯片)与预研导入。
3. 软硬协同与全栈逻辑构建
- 构建硬件拓扑: 负责构建从底层芯片(NPU/GPGPU/TPU, CPU, Switch)、单板硬件(互联、电源)到整机柜/机架级别的完整硬件拓扑架构。
- 打通软硬逻辑: 建立从业务需求(模型大小、并行策略)到上层软件框架、算子算法的映射与逻辑关系。
- 与芯片、OS、算法、硬件、运维等跨领域团队紧密协作,实现全栈性能优化。
4. 架构体系建设与团队赋能(核心价值)
- 统一关键设计约束,制定服务器架构设计规范与标准,建立并完善体系化的架构评审机制,有效减少团队重复试错成本。
- 发挥技术领导力,通过架构指导与技术分享,带动团队形成体系化的架构方法论,从长期维度提升团队的交付质量、研发效率及整体技术能力。

岗位要求
1. 教育与经验背景
- 计算机、电子工程、人工智能、通信等相关专业本科及以上学历。
- 具有5年以上服务器硬件或高性能计算(HPC)系统架构经验,2年以上AI/GPU服务器相关项目实战经验。
- 具有头部大厂(如字节、华为、阿里等)的实际项目成功落地经验,对数据中心的最新发展方向有深刻且前瞻的理解。
2. 硬件与系统架构能力
- 精通AI超节点与集群架构: 熟悉NVL72, B200/B300, 阿里磐久, 华为ub-mesh 384, Google TPU v6/7/8/9等业界前沿AI数据中心超节点的发展脉络。
- 具备极强的系统构建能力,能够清晰规划并构建从芯片(NPU/GPGPU/TPU, CPU, Switch)到单板硬件(互联、电源),再到机架的完整硬件拓扑。
3. 软硬协同认知
- 深入了解深度学习训练、推理流程及常用框架的硬件需求。
- 能够深刻理解并构建从模型大小、并行策略等业务需求,到软件、算子算法的逻辑关系,具备软硬协同设计的实战经验。
4. 综合素质与领导力
- 架构思维: 具备优秀的全局观和系统性思维,能够完美平衡技术前瞻性、业务需求与成本控制。
- 落地与推动: 具备极强的跨团队沟通与项目推动能力,能有效打破部门壁垒,推动定制化方案及架构规范的落地。
- 团队赋能: 具备技术领导力,乐于分享,有带领或指导团队提升整体技术体系能力的意愿和经验。

电子/硬件开发方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →