锦鲤求职

阶跃星辰

语音大模型开发工程师

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

岗位职责

负责语音大模型实时交互能力的工程化落地,推进模型从研发环境到推理部署、服务化及线上环境的交付;

负责实时语音模型的推理与性能优化,围绕低延迟、流式处理、资源效率等核心指标,优化模型服务运行效率;

负责实时语音交互相关工程模块的设计与开发,包括推理模块、Streaming、模型前后处理、Harness 等,提升模型运行效率与稳定性;

参与线上实时语音交互问题的定位与优化,针对效果、性能、稳定性和资源成本等问题进行分析并推动解决;

与算法、平台、产品等团队协作,将模型能力转化为稳定、可复用的工程模块,支持模型及业务快速落地;

跟踪语音大模型及实时语音交互领域的工程技术发展,参与推理优化、服务化及相关工程能力建设。

任职要求

计算机、软件工程、电子、人工智能等相关专业,本科及以上;

具备较强的算法工程和系统工程能力,有语音、音频、多模态或大模型相关工程经验;

有流式 / 实时语音处理或大模型推理部署经验,理解低延迟场景下的模型推理、服务和系统优化问题;

熟悉 Python,具备较强的GO工程能力,能够独立完成推理模块、算法服务及相关工程系统的设计与开发;

熟悉 PyTorch 等主流深度学习框架,理解模型推理、部署及线上服务链路;

熟悉模型服务化和工程部署,具备将模型从研发环境交付至生产环境的实际经验;

具备较强的问题定位和工程优化能力,能够针对性能、稳定性、资源利用率等问题进行系统性分析和优化;

具备较强的跨团队协作能力,能够与算法、平台、产品等团队协作推进复杂项目落地。

加分项

有对外 API 或大规模线上模型服务交付经验,熟悉服务治理、监控、告警、灰度发布、版本管理等生产环境能力;

熟悉推理加速与部署技术,如 vLLM、量化、流式推理等;

有实时语音大模型、Voice Agent、全双工语音交互等相关工程经验;

有模型 Harness、推理 Runtime、Streaming 等相关开发经验;

有较强的模型性能 Profiling 和优化经验,能够从模型、推理框架到系统层进行端到端优化。

人工智能方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →