锦鲤求职

沐曦股份

高性能计算及AI基础模块专家(Flash Attention)

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

岗位职责:

1. 负责AI算子库(FlashAttention/FlashInfer/FlashMLA/SpargeAttention)在沐曦GPU上的适配和优化,演进先进的LLM技术;

2. 负责AI框架中核心算子在沐曦GPU上的适配、融合与优化,演进软硬件协同技术;

3. 支持流行的开源AI框架以及客户定制的AI框架;

4. 支持流行的开源科学计算应用(数学,物理,化学,医药等),工程仿真,预测预报等。

岗位要求:

1. 熟悉FlashAttention和FlashInfer,了解vLLM/SGLang/Megatron-LM;

2. 至少3年C++编程经验;

3. 具有CUDA, ROCM, OpenCL相关开发经验者优先;

4. 优先加分项:具有AI算子开发和优化经验;

5. 优先加分项:具有AI训练框架和AI推理框架交付经验;

6. 优先加分项:具有tileLang/triton等DSL开发经验。

人工智能方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →