岗位描述
(岗位可base北京、长沙、无锡)
岗位职责:
1. CUDA生态迁移与跨平台适配
主导 CUDA 应用向ROCm/OpenCL 平台的迁移、重构与性能对齐,保障功能一致、性能接近。
开发迁移工具 SDK 与适配文档,解决编译、内存模型、通信接口等兼容问题。
维护主流框架(PyTorch/TensorFlow等)的 CUDA 适配分支,跟进版本迭代与 Bug 修复。
2. CUDA 核心技术开发与优化
运用Triton 等库实现高性能 Kernel,优化 Warp 调度、Shared Memory、异步拷贝等关键技术。
用 Nsight 工具链做性能剖析,建立调优方法。
3. 开发者生态运营与赋能
构建 CUDA 开发者技术体系:编写示例代码,建设知识库与 FAQ。
对接 ISV与开源项目,推动其软件深度适配。
4. 技术前瞻与标准建设
跟踪 CUDA 最新特性及 GPU 技术趋势,参与行业标准制定。
任职要求:
1. 学历与基础背景
本科及以上,计算机、软件工程、电子信息、应用数学、计算力学、物理等相关专业;硕士优先。扎实的计算机基础,理解 CPU/GPU 异构计算原理。
2. 核心技术栈(硬要求)
编程语言:精通 C/C++,熟练使用 Python 做脚本、自动化测试、数据分析;了解 Shell/Linux 常用命令。
3.3 年及以上 CUDA 实际开发经验;
掌握通用 Kernel 开发、访存优化、并行策略,熟悉 Tensor Core、低精度计算(FP16/FP8/INT8)。
熟练使用 CUDA 生态库:cuBLAS、cuFFT、cuDNN、NCCL、CUTLASS 等。
会使用 Nsight 系列工具做性能分析与调优。
4. 加分项
有 CUDA 代码向 HIP/ROCm、国产 GPU 迁移改造经验。
5. 综合软技能
沟通能力强,可对接内部团队、外部开发者、企业客户。