岗位描述
岗位职责
岗位职责:
1. 负责多模态交互算法的研发,聚焦语音、视觉、文本、触觉等多模态数据的融合理解与生成,打造自然、智能的人机交互体验;
2. 研发多模态大模型交互核心算法,解决多模态情感计算、意图识别、上下文理解、交互生成等关键技术问题;
3. 负责算法模型的轻量化、性能优化与端侧部署,推动算法在智能终端、服务机器人、智能座舱等场景的落地应用;
4. 跟踪多模态交互领域前沿技术,进行技术预研与创新,形成核心技术壁垒。
岗位要求
任职资格:
1. 博士学历,计算机科学与技术、人工智能、人机交互、语音信号处理等相关专业;
2. 精通多模态学习、深度学习、自然语言处理、计算机视觉核心技术,有多模态交互、人机对话、情感计算等相关领域项目或研究经验;
3. 熟练使用PyTorch/TensorFlow等深度学习框架,具备扎实的算法研发与工程实现能力;
4. 具备优秀的创新能力与问题解决能力,在相关领域顶级会议/期刊发表论文者优先。