岗位描述
角色和团队介绍: 团队负责燧原科技自研 AI 加速器的高性能算子模板库与 kernel DSL 编译器开发。算子库方面,团队通过 C++ 模板元编程构建可组合的高性能计算框架,覆盖 GEMM、卷积、Attention 等核心算子;编译器方面,团队开发基于 MLIR 的 Python kernel DSL,通过编译技术自动生成高性能目标代码。团队直接服务于 LLM 推理与训练的性能底座,技术栈横跨 C++ 模板元编程、MLIR 编译器开发与硬件体系结构。
岗位职责和实习内容:
1. 负责 AI 加速器高性能算子模板库的开发与优化(GEMM、卷积、Attention 等)的开发与优化;
2. 参与 kernel DSL 编译器开发,包括 MLIR Op 实现、JIT 编译管线与后端代码生成;
3. 参与新硬件特性的软件适配、性能分析与调优;
4. 编写测试用例与性能 benchmark,保障算子库正确性与性能达标。
岗位要求:
1.2027届硕士及以上学历,计算机科学、电子工程、数学等相关专业
2.扎实的C/C++与Python编程能力
3.了解计算机体系结构(存储层次、SIMD/SIMT、并行计算),编译原理(IR、代码生成、优化)
4.具有较强的独立解决问题的能力
5.具有不错的沟通交流和团队合作能力
6.具备英文技术文档阅读能力
* 加分项:
1.CUDA/CUTLASS开发经验
2.MLIR/LLVM开发经验
3.Triton/TVM开发经验
4.HPC竞赛
5.相关论文或者开源贡献
地点:上海