岗位描述
岗位职责:
1. 负责AI算子库(FlashAttention/FlashInfer/FlashMLA/SpargeAttention)在沐曦GPU上的适配和优化,演进先进的LLM技术;
2. 负责AI框架中核心算子在沐曦GPU上的适配、融合与优化,演进软硬件协同技术;
3. 支持流行的开源AI框架以及客户定制的AI框架;
4. 支持流行的开源科学计算应用(数学,物理,化学,医药等),工程仿真,预测预报等。
岗位要求:
1. 熟悉FlashAttention和FlashInfer,了解vLLM/SGLang/Megatron-LM;
2. 至少3年C++编程经验;
3. 具有CUDA, ROCM, OpenCL相关开发经验者优先;
4. 优先加分项:具有AI算子开发和优化经验;
5. 优先加分项:具有AI训练框架和AI推理框架交付经验;
6. 优先加分项:具有tileLang/triton等DSL开发经验。