岗位描述
岗位职责
vivo AI研究院致力于研发业界领先的人工智能技术,通过AI技术创新持续为全球5亿+vivo用户带来无处不在的惊喜和激动人心的智慧体验。
在这里你将致力于:
1. 参与端侧/云侧语音算法的研发与优化,方向包括:语音识别(ASR)、语音合成(TTS)、声纹识别等。
2. 跟进语音技术前沿算法和技术,完成算法预研、模型训练与评测,跟踪语音领域前沿技术并复现、改进相关方案。
3. 参与数据处理、模型压缩与端侧部署,协助算法在手机/Pad等终端产品上落地。
4. 与团队协作,参与算法从实验到上线的工程化全流程。
岗位要求
1、计算机、电子信息、信号处理、人工智能、数学等相关专业,硕士及以上优先。
2、具备扎实的机器学习/深度学习基础,理解 Transformer、CNN/RNN、注意力机制等基本原理。
3、熟练使用 Python,了解 PyTorch/TensorFlow 等深度学习框架。
4、了解语音或音频信号处理基础(如 Fbank/MFCC、频谱分析)者优先。
5、学习能力强、对语音/AI 技术有热情,具备良好的逻辑思维与团队沟通能力。
6、优选条件:
- 有语音相关项目、实习、竞赛或开源贡献经历。
- 在 ICASSP、INTERSPEECH等会议发表过论文。
- 熟悉至少一个语音工具链(Kaldi、ESPnet、WeNet、FunASR、k2等)。
- 了解语音大模型、端到端语音交互或端侧模型部署。