岗位描述
岗位职责
1. 负责深度学习算法在AI芯片上的模型适配、优化与部署工作,确保模型在目标硬件上的高效运行。
2. 开发和维护模型转换工具链,支持主流框架(如PyTorch, TensorFlow, ONNX等)到芯片专用格式的转换。
3. 针对特定芯片架构(NPU/GPU/DSP)进行算子开发与优化,提升模型推理性能,降低延迟与功耗。
4. 协同算法团队与系统软件团队,解决模型落地过程中的精度损失、内存占用及兼容性问题。
5. 编写相关技术文档,包括模型接入规范、性能分析报告及用户指南。
任职要求
1. 计算机、电子工程、数学或相关专业本科及以上学历。
2. 熟练掌握C/C++/Python编程语言,具备良好的代码规范和调试能力。
3. 深入理解常见深度学习网络结构(CNN, Transformer, RNN等)及其计算特性。
4. 熟悉至少一种主流深度学习框架,并有模型量化、剪枝、蒸馏等压缩优化经验者优先。
5. 具备异构计算编程经验(如CUDA, OpenCL)或熟悉底层硬件架构者优先。
6. 具有良好的沟通协作能力和问题分析解决能力,对新技术保持敏感。