岗位描述
岗位职责
参与语音增强(降噪、回声消除、波束成形)、KWS / 免唤醒词、声纹识别、ASR / TTS、音频事件检测等算法的研发与落地,使算法在低信噪比真实场景下稳定可用;
参与麦克风阵列方案设计、需求分析、数据迭代与性能优化,在端侧 SoC 上完成轻量化部署与 HAL 层集成,保障实时性与功耗平衡;
编写高质量代码,完成算法 SDK 封装,输出方案与技术文档;
配合团队完成麦克风、音频芯片与算力平台的选型验证与问题定位,并与外部音频 / 芯片厂商进行技术对接与方案评审,协同推进方案落地闭环;
跟踪语音算法与端侧语音框架进展,将可用成果引入在研项目。
任职要求
必备
计算机、数学、自动化、电子信息等相关专业,硕士及以上学历;
扎实的语音信号处理与语音算法基础,熟悉 CNN、RNN、Transformer 等主流架构,理解回声消除、降噪、VAD、KWS、声纹、ASR 中至少一类的算法原理,能讲清其工程难点;
熟练使用 Python / C++ 与 PyTorch,具备独立实现与调试算法模块的能力;
具备良好英文技术文献阅读能力,能跟进 ICASSP / Interspeech 等顶会论文并提炼可用方法。
加分项
有麦克风阵列仿真 / 调优,或端侧 DSP / NPU 语音部署的实践经历;
有相关课题、竞赛或实习经历;
有跨团队协作与问题定位经验。