岗位描述
岗位职责:
1.数据闭环与挖掘:设计自动驾驶数据挖掘与打标的链路,优化基于主动学习的数据挖掘策略,开发长尾场景与 Corner Case 挖掘算法,提升数据集多样性;
2.VLM 模型构建:负责云端视觉语言模型的开发与迭代,研究指令微调与领域适配方法,构建基于 VLM 的通用打标能力,降低规则打标占比;
3.数据平台建设:主导元数据管理与非结构化数据存储设计,优化向量检索与时空索引性能,基于 Spark/Flink 构建高吞吐量数据处理流水线;
4.跨团队协作:与算法团队配合,分析训练数据分布,通过主动采集等形式平衡数据整体分布,提升模型性能;
5.前沿跟踪:跟踪学术界与工业界最新进展(如 OpenScene、DriveLM 等),推动算法迭代。
任职要求:
1.计算机科学、人工智能等相关专业硕士及以上,有自动驾驶数据背景优先;
2.熟练使用 **agentic-coding**(Cursor / Claude Code / Copilot Workspace 等 AI 辅助编程工具)提升研发效率;
3.熟悉深度学习与 PyTorch/TensorFlow,有 VLM/LLM(CLIP/BLIP/Flamingo 等)开发经验,有大模型微调或 Prompt 工程经验加分;
4.扎实的计算机视觉基础,熟悉目标检测、语义分割、BEV 感知等任务;
5.精通大数据处理技术(Spark/Hadoop/Flink),熟练使用 SQL 与 NoSQL,有向量数据库(Milvus/Faiss)或 Elasticsearch 应用经验优先;
6.精通 Python/C++,熟悉分布式系统设计、微服务架构、Docker/K8s 及消息队列。
加分项:有顶会/顶刊论文、顶级学术比赛成果、火山云生态(EMR/ByteHouse)经验、大数据架构或数据湖仓经验。