岗位描述
岗位职责
1、负责将图像识别、NLP、大模型等AI算法轻量化并部署到移动端、嵌入式设备或PC端;
2、运用量化、剪枝、蒸馏等技术,降低模型体积、内存占用与推理延迟;
3、熟悉并适配主流端侧推理框架,构建模型转换、性能剖析工具链;
4、与硬件/ESP团队协作,完成AI加速卡集成调试,保障系统级稳定;
5、参与基于大语言模型的Agent应用开发。
岗位要求
1、本科及以上学历,计算机/人工智能/电子等相关专业,2年以上端侧AI工程化经验,有量产落地项目优先;
2、熟悉C++/Python,熟悉Linux及交叉编译,熟悉量化(INT8/INT4)、剪枝、蒸馏等模型压缩方法;
3、熟悉TensorRT、ONNX Runtime、TFLite、MNN、NCNN、RKNN、QNN中至少两种,并有实际部署经验;
4、在瑞芯微、恩智浦、英伟达、高通中至少1个平台上完成过模型部署与调优。