锦鲤求职

好未来

语音合成算法工程师

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

岗位职责:

承担教育场景下的语音合成,负责 TTS 前端、声学模型、声码器等核心模块的算法设计与改进,提升合成语音的自然度、流畅度与情感表现力。

负责 TTS 数据预处理、模型预训练、微调及强化学习相关工作,完成模型性能评估与迭代优化。

研究并实现段落或篇章级的韵律建模方案,优化长文本语音合成中的停顿、重音及情感表达。

推动语音合成技术在公司产品中的应用,针对业务场景进行模型调优与效果优化,支持个性化及情感合成的业务需求。

跟进语音合成的最新动态,包括大模型 TTS、Flow Matching、Diffusion-based TTS 等,探索创新方案并推动其在实际场景中的落地。

岗位要求:

学历要求:硕士及以上学历,计算机科学、信号处理、电子信息、模式识别相关专业优先。

在语音合成(TTS)方向有1-3年的工作经验,有工业级 TTS 系统上线经验,并熟悉语音合成质量评估方法(如 MOS、AB 测试等)。

深入理解 TTS 原理,具备篇章级韵律建模与情感语音合成研发经验优先。

熟悉 Python 编程语言,精通 PyTorch 框架,具备大规模分布式模型训练经验。

加分项:

具备端到端语音大模型(Speech + Text 联合训练)的训练与调优经验;

有语音编解码器(如 Audio Codec、Neural Audio Codec)的实践研发经验;

有语音技术相关论文在 Interspeech、ICASSP 等顶级学术会议发表;

6.具备优秀的问题解决能力与团队协作精神,能积极应对技术挑战并推动任务目标的顺利实现。

人工智能方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →