岗位描述
岗位职责
Seed 大模型人才校招,是字节跳动 Seed 面向高校人才推出的招聘项目。我们始终相信,真正重要的技术进步来自对高难度问题的持续挑战。面对 AI 时代的巨大机遇,Seed 团队并不止步于模型迭代,而是选择进入技术深水区,推进下一代 AI 范式突破,不断探索智能的边界与上限。
团队介绍:字节跳动 Seed 团队成立于 2023 年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。Seed 团队在 AI 领域拥有长期愿景与决心,团队研究方向涵盖 MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE 等超过 50 个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包 App 用户量在中国市场排名第一,豆包大模型日均 Token 调用量行业领先。
我们希望打造能够感知环境、理解人类意图、可调用工具/Agent实际执行任务的Realtime多模态交互模型,为视频通话、智能硬件、机器人等产品提供自然、流畅、有主动性的新交互体验。
1、负责Realtime视觉多模态交互模型的Post-Training优化与研发,持续提升长多轮对话、上下文理解、工具调用及复杂指令遵循能力;
2、优化模型对实时音视频流的感知与理解能力,包括空间关系理解、视觉指代与视觉问答等;
3、研发Realtime多模态交互的新能力,包括基于视觉环境的主动响应、Realtime Agent、长期与个性化Memory等;
4、参与智能硬件/机器人等产品的实际效果优化和落地;
5、探索多模态交互、人机协作领域的前沿技术,并转化为实际用户体验的提升。
岗位要求
1、2027届获得硕士及以上学位,人工智能、计算机、自动化、数学等相关专业优先;
2、有视频大模型训练、智能硬件、机器人相关研究经验者优先,在顶级学术会议上发表过多模态/机器人交互相关研究论文者优先;
3、责任心强,积极主动,有良好的沟通能力和团队合作能力;
4、对Realtime多模态交互产品有热情,能够从用户体验出发定义问题并持续优化。对智能硬件、机器人应用有强烈兴趣者优先。