锦鲤求职

得一微电子

AI存力芯片工程师(校招)(J10186)

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

岗位职责
负责Transformer大模型在AI芯片端的推理优化与落地,包括模型量化(INT4/INT8)、稀疏化、算子融合、内存复用等核心技术攻关。
参与AI推理框架(如MindSpore、vLLM、TensorRT-LLM等)的开发与适配,完成大模型pipeline的编写、优化与稳定性保障。
对接芯片硬件架构,分析Transformer模型的访存与算力瓶颈,提出硬件友好的算法优化方案。
主导多模块协同开发与跨部门协作,确保大模型推理项目在端侧/边缘设备上的高效交付与性能达标。
持续跟踪AI推理与芯片技术前沿,迭代优化大模型在硬件平台上的推理速度与稳定性。

岗位要求
任职要求
(一)核心硬性要求
底层能力:精通Transformer底层原理,深入理解自注意力机制、多头注意力等核心模块,能从数学与工程层面分析大模型推理瓶颈。
工程经验:具备3年及以上大模型推理优化或AI芯片算子开发经验,有端侧/边缘设备部署实战案例。
技术栈:熟悉至少一种主流AI推理框架(MindSpore/PyTorch/TensorRT),掌握模型量化、稀疏化、算子优化等落地技术;了解NPU/GPU硬件架构优先。
编码能力:熟练使用C++/Python进行工程开发,能独立完成推理pipeline的编写与调试。
(二)优先条件
有云天励飞、地平线、安菲翁等AI芯片/大模型公司工作经验者优先。
参与过千亿级参数大模型推理优化或AI芯片流片项目者优先。
熟悉RISC-V架构、CUDA/TVM算子开发、容器化部署(Docker/K8s)者优先。

人工智能方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →