岗位描述
岗位职责
1. 参与多模态智能体及视觉内容分析相关算法的研发与优化。
2. 探索大模型与外部工具协同的任务规划、多轮推理和自主决策方法。
3. 参与模型数据构建、训练适配、推理优化及工程验证。
4. 建设模型评测体系,持续提升算法的准确性、鲁棒性、泛化能力和可解释性。
5. 开展前沿技术调研、论文复现和原型验证,推动研究成果在实际场景中落地。
岗位要求
1. 计算机、人工智能、自动化、电子信息等相关专业,本科高年级或硕士博士在读;优秀本科生也可以。
2. 熟练使用 Python,具备扎实的 PyTorch、NumPy、OpenCV 实践能力。
3. 熟悉深度学习和计算机视觉基本概念, 使用过至少一种视觉或多模态模型,例如 Qwen-VL、InternVL、LLaVA、CLIP。
4. 能够独立阅读英文论文,并将论文方法转化为可运行、可评测的代码。
5. 能连续实习 4–6 个月,每周不少于 4 天, 不可远程。