岗位描述
岗位职责:
1. 负责完成算法模型及SDK到国产GPU的移植、部署与优化;
2. 负责对相关算法和模型进行通用代码优化,针对国产GPU进行高性能计算加速及工程化;
3. 进行AI技术研究,包括GPU硬件架构、CUDA软件栈,熟练掌握各常用模块的问题分析和性能优化;
4. 负责AI主流学习框架、常见网络模型及应用层的性能调优;
5. 支持客户AI应用的测试及性能调优,解决国产GPU产品与客户人工智能业务场景对接过程中产生的训练、推理、精度等问题。
任职要求:
1. 本科及以上,计算机相关专业;
2. 有AI方向研究经验,掌握常见的深度学习算法模型;熟悉常见的机器学习算法模型及原理;
3. 掌握至少一种主流学习框架的编程架构,熟悉网络模型训练/推理流程;
4. 熟练Linux的系统,包括软件安装/系统配置/Shell编程,具备系统故障排查及解决能力;
5. 熟练掌握Python开发,并掌握程序调试方法;熟悉使用Python数据处理以及深度学习相关库;
6. 具备CUDA或HIP编程经验的优先;
7. 具备良好的沟通能力、团队合作和分享意识。