岗位描述
岗位职责
团队介绍:产品研发和工程架构-Seed 团队深耕大模型技术在场景中的创新应用,负责多款AI产品的工程研发 —— 包括豆包、飞书、豆包工作、豆包爱学、Gauth、猫箱等创新产品,覆盖消费级与企业级多个场景。我们致力于将大模型能力从 "生成内容" 推进到 "完成工作",让 AI 服务用户日常与企业协作。你将面对多模态交互、工具调用可靠性、企业级数据安全等真实工程挑战,与团队一起推动 AI 生产力落地。
1、协助算法研发工作:
1)协助进行语音识别(ASR)算法的优化与测试,参与高精度语音处理系统的迭代;
2)支持语种识别(LID)、说话人分离(SSD)、声纹(SID)等技术的研发落地,参与数据处理与实验验证;
3)学习Whisper/FunASR/3D-Speaker等开源项目,结合业务场景参与技术改进方案讨论;
2、参与技术落地实践:
1)参与会议转录、实时字幕等ToB办公场景的语音算法应用测试;
2)协助优化语音模型推理性能,收集并分析模型部署中的问题;
3)参与语音领域数据集整理与评测体系搭建;
3、支持团队协作工作:
1)配合产品团队进行需求分析,整理技术实现思路;
2)协助工程团队完成模型部署测试,记录并反馈落地过程中的技术问题。
岗位要求
1、2027届获得本科及以上学历,语音信号处理、声学、计算机、人工智能等相关专业优先;
2、掌握Python及基础AI工具(NumPy等),了解PyTorch/TensorFlow等深度学习框架;
3、具备语音信号处理基础,了解ASR基本原理(前端处理/特征提取等);
4、对语音算法有浓厚兴趣,愿意学习前沿技术,具备良好的逻辑思维能力;
5、具备一定的问题分析能力,能积极沟通并推进问题解决。
加分项:
1、有语音相关算法项目经验或开源项目贡献经历;
2、了解CUDA编程或TensorRT等推理加速工具;
3、阅读过语音领域顶会(ICASSP/INTERSPEECH)论文;
4、具备多语种语音处理相关学习或实践经历。