岗位描述
岗位职责
负责自研 GPU 编译器整体架构设计、技术路线规划与团队管理,统筹编译工具链开发迭代。
主导 LLVM/MLIR 编译链路优化,包含算子融合、指令调度、访存优化、硬件指令生成等核心模块开发。
对接硬件、驱动、AI 框架团队,结合 GPU 硬件特性定制编译策略,提升大模型、通用计算场景算力性能。
搭建编译精度、性能回归测试体系,解决编译报错、性能瓶颈、兼容性问题。
统筹团队任务拆解、技术攻关与人才培养,保障芯片项目交付节点。
任职要求
本科及以上,计算机相关专业;5 年以上 GPU/AI 编译器开发经验,2 年以上团队管理经验,有芯片量产落地经验优先。
精通编译原理,熟练使用 LLVM、MLIR,熟悉 GPU 硬件架构与执行模型。
熟悉 CUDA/ROCm、PyTorch/TensorFlow 编译链路,有算子编译、图优化实战经验。
具备独立架构设计、跨部门协同、难点问题攻坚能力。