岗位描述
岗位职责
1、面向智慧城市大规模图像/视频内容分析场景,参与VLM、MLLM等多模态算法的研究工作,探索城市视觉智能更好的解决方案,帮助下游产品线在行业内建立技术优势;
2、构建和维护相关研究方向的代码框架、数据基础,紧跟学术前沿,输出创新研究成果。
岗位要求
1、计算机、电子信息、数学等相关专业硕士及以上学历;
2、熟练使用Python和C/C++,掌握PyTorch, Tensorflow等深度学习框架之一;
3、熟悉目标检测、跟踪、分割、分类等传统视觉算法,具有跨模态算法的研究经验,对多模态算法的研究和落地具有强烈的热情;
4、在CVPR/ICCV/ECCV/NeurPS/ICLR/ACL/EMNLP等学术顶会有相关论文发表,或在相关国际竞赛中取得优异成绩者优先;
5、参与过有影响力的多模态算法项目者优先;
6、具有优秀的分析问题和解决问题的能力,具有良好的沟通能力和团队合作能力,在工作中敢于突破与创新,对解决具有挑战性的问题充满激情。