岗位描述
岗位职责
1、供应商模型调优:对接语音供应商 API/模型,做深度参数调优、效果评估与版本回归;
2、训练数据准备:负责多场景语音数据(ASR/TTS/多语种)的采集、清洗、标注与质量评估;
3、自研模型建设:参与 TTS/ASR/Audio LLM 的训练、微调(LoRA/SFT)与部署,搭建可复用 pipeline;
岗位要求
1、本科及以上,通信/计算机/电子/AI 等相关专业,可以接受优秀实习生;
2、熟练 Python / PyTorch / HuggingFace / Linux / Docker;
3、有 ASR、TTS 或音频处理项目经验,大规模语音数据治理经验者优先;
4、有 Audio LLM / 说话人识别 / 语音合成经验者优先;
5、有顶会论文/专利或多智能体、RAG、Embedding 对齐经验者优先;