锦鲤求职

浪潮数字企业

大模型推理应用工程师

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

岗位职责:
1、协助完成Llama、Qwen、Baichuan等开源大模型本地化、私有化推理部署工作,负责推理环境搭建、调试与试运行,保障大模型推理服务稳定可用,支撑AI业务场景落地;
2、参与大模型推理性能优化工作,落地模型量化、剪枝、推理加速、显存优化等关键技术,有效降低推理延迟、提升吞吐效率,适配多类硬件推理场景;
3、负责大模型推理服务常态化监控、故障排查与迭代优化,梳理推理异常与性能瓶颈,输出专项优化报告,持续提升推理服务稳定性与响应效率;
4、依托Linux、K8S环境完成大模型应用工程化部署、接口联调与功能测试,排查线上报错及性能问题,实现模型轻量化部署与稳定运维;
5、配合团队推进大模型推理相关项目落地、测试与验收工作,协同产品及业务团队解决推理环节技术问题,助力业务智能化迭代升级。

任职要求:
1、硕士及以上学历,计算机、人工智能、软件工程、大数据、自动化等相关专业,有无经验均可,具备相关项目或实习经历者优先;
2、具备扎实的计算机基础知识,熟练掌握Python编程语言,熟悉数据结构、操作系统、计算机网络相关理论,代码规范,具备基础问题排查能力;
3、熟悉大模型基础原理与Transformer核心架构,掌握大模型推理基本流程,了解Qwen、Llama、Baichuan等开源模型及VLLM、Sglang等推理框架者优先;
4、善于借助AI研发工具辅助编码、调试与技术分析,能够利用AI工具提升脚本开发、问题排查与方案落地效率,熟练赋能研发全流程者优先;
5、自主学习能力突出,可快速跟进大模型前沿技术,乐于技术沉淀与经验分享,具备良好的文档撰写、沟通协作能力与岗位责任心,可独立负责模块落地工作。

人工智能方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →