岗位描述
工作职责
1.负责AI推理SDK以及模型部署工具链的需求开发、维护&调优;
2.支持客户端侧模型在平台的部署,解决性能调优、精度损失等相关问题;
3.跟踪端侧AI与大模型(LLM/VLM)部署的前沿技术,结合业务需求推动SDK架构的持续演进与升级。
工作要求
1.精通C/C++编程,熟悉Linux/Android嵌入式开发环境
2.深入理解主流深度学习框架(PyTorch/TensorFlow/ONNX)及推理引擎(如TensorRT、TVM、NCNN、MNN、TFLite等),有实际的模型转换、算子开发经验
3.掌握量化、蒸馏、剪枝等模型压缩技术,有端侧模型优化经验
【加分项】
有高通(SNPE/QNN)、联发科(NeuroPilot)或其他AI芯片厂商SDK开发经验者优先
熟悉座舱域(如多模态交互、DMS/OMS、语音唤醒识别)或智驾域(如目标检测、BEV感知)的算法模型特性,有相关芯片平台的NPU部署与性能调优实战经验