岗位描述
岗位职责
1.对接架构团队共同确定 NPU Core/子系统方案,输出具备竞争力的微架构文档与 PPA 指标;
2.独立负责 Tensor Core / Vector Core / Scalar Core / Scheduler / DMA等完整的 RTL 落地;
3.规划数据流与 Memory Hierarchy(L1/Scratchpad/RF),设计 DMA 与总线接口,最大化算力利用率;
4.与算法、编译器、工具链协同,完成关键算子(MatMul/Conv/Norm/Softmax/Attention)的硬件友好映射与性能闭环;
5.负责模块级Lint/CDC、综合与高频时序优化;配合 DV/PR 解决复杂 bug 与 congestion;
6.支持 FPGA/Emulation 与 runtime bring-up;持续做能效与面积优化。
任职要求
1.硕士及以上;5年以上 ASIC 前端经验,必须有 NPU / GPU Shader / 高性能 DSP 核心设计经历;
2.深入理解并行计算与存储层次;精通矩阵运算硬件实现与数据复用策略;
3.熟悉 AI 算子特征及对带宽/片上存储的需求;有性能分析与硬件优化实绩;
4.精通 RTL 与前端 flow(含 SDC/UPF 基础);
5.有 Python/C++ 做建模或 co-sim 相关经验者优先;
6.有端侧或云端 AI 芯片 NPU 相关流片经验者优先。