岗位描述
岗位职责
1、负责视觉感知相关算法的研发与优化,包括:
(a)开放世界检测 / 开放词汇检测
(b)多模态视觉检测与理解
(c)Best Moment / 精彩时刻检测
(d)显著性检测 / 主体检测
(e)目标检测、视频理解等相关方向
2、结合实际业务场景,完成算法方案设计、模型训练、效果评测及持续优化。
3、跟进计算机视觉及多模态方向前沿技术,并推动新技术在实际产品中的落地。
4、负责数据分析、Badcase 分析、Benchmark 建设及算法效果提升。
5、配合工程团队完成模型部署及性能优化。
任职要求
1、计算机、人工智能、电子信息、自动化等相关专业,硕士及以上学历。
2、具备 5 年以上检测/跟踪/多模态视觉方向经验。
3、熟悉计算机视觉和深度学习基础,具备目标检测、图像理解或视频理解相关经验。
4、熟悉 PyTorch 等深度学习框架,能够独立完成模型训练、评测和优化。
5、对以下一个或多个方向有一定经验或兴趣:
(a)Open-World / Open-Vocabulary Detection
(b)Vision-Language / 多模态视觉
(c)Saliency Detection
(d)Best Moment / Video Highlight Detection
(e)Object Detection / Video Understanding
6、具备较好的论文阅读、算法调研和问题分析能力。
加分项
1、有多模态视觉、大模型或开放世界检测相关项目经验;
2、有目标检测、跟踪、ReID、主体识别等视觉感知项目经验;
3、有视频理解、智能抓拍、精彩时刻检测相关经验;
4、有模型轻量化、量化或端侧部署经验;
5、有相关论文、竞赛或开源项目经验。