岗位描述
岗位描述
1. 参与语音tokenizer,ASR,TTS、端到端对话、音乐等算法及新技术方案的研发,推进语音新技术的突破;
2. 参与可控语音生成、语音对话、情感理解及交互等场景的算法方案设计和研发,同时负责推进整体方案的落地;
3. 参与在大模型技术栈下,新业务场景、新交互形态、新算法应用的调研和探索。
岗位要求
1. 本科及以上学历,语音、多模态、机器学习、计算机相关专业,
2. 熟悉语音识别、语音生成、语音前端、端到端对话等语音算法原理;
3. 有语音交互项目的推进和落地经验,熟悉业界主流的语音系统实现方案。
加分项
1. 在多模态/语音/语言大模型领域有科研或项目实践经验,在国际顶级会议/期刊发表过高质量论文;
2. 大模型分布式训练、AI Infra等领域有科研或实践经历。