岗位描述
岗位职责
AI画质增强与智能编解码:推动AI技术与音视频编解码结合,开展超分辨率、去噪、插帧、画质修复、智能编码及码率优化等技术研发。
多模态数据与模型优化:参与视频模型调优,建设多模态训练数据,优化AIGC模型训练与推理性能。探索人物驱动、数字人生成等技术。
电商视频与直播场景落地:推动视频生成、图像处理及音视频技术在商品展示、营销短视频、数字人直播和虚拟主播等场景中落地。
技术方案与能力建设:负责关键技术方案设计、核心模块开发和效果评测,协同算法、工程、产品及业务团队推进项目交付,并沉淀可复用的技术能力。
职位要求
计算机、人工智能、电子信息、通信工程、数字媒体等相关专业本科及以上学历,具备 5年以上 音视频编解码、图像处理、计算机视觉或AI图像/视频模型研发经验。
熟悉H.264、H.265、AV1等主流编解码标准,或具备画质增强、超分辨率、去噪、插帧、智能编码及码率优化等项目经验。
在音视频编解码、图像与视频处理、视频生成、数字人或多模态模型中的至少一个方向具备深入经验,有规模化业务落地经验者优先。
熟悉PyTorch及生成式AI相关技术,具备模型训练、调优、部署或推理加速经验;有GPU编解码、CUDA优化、端侧部署或异构计算经验者优先。
具备较强的问题分析、技术方案设计和项目推动能力,能够独立负责核心技术方向并推动业务落地。
有电商视频、营销短视频、数字人直播或虚拟主播相关经验,参与过FFmpeg、x264、x265、SVT-AV1等开源项目,或在相关顶会、顶刊发表过论文者优先。