岗位描述
岗位说明:参与数据平台的建设,负责数据架构设计与开发。具体包括:
- 设计并开发数据仓库、数据湖及实时计算体系,支撑业务分析与 AI 模型的离线/在线数据需求;
- 参与面向大模型的数据体系建设,包括数据清洗、去重、质量评估、多模态数据处理等,为AI应用场景提供高质量数据集;
- 建设指标体系和数据治理机制,保障数据一致性与高可用性;
专业要求:
- 2027 届本科及以上学历,计算机、软件工程等相关专业;
- 熟悉数据仓库方法论与维度建模,掌握离线和实时数据开发流程;
- 熟悉大数据生态(Spark/Flink/Hive/Kafka/ElasticSearch 等),理解其原理与适用场景;
- 精通 Python/Java 中至少一门,Python 优先,具备良好的工程编码习惯;
- 了解大模型数据需求与向量数据库(如 Milvus/Pinecone 等)概念,有相关实践经验者优先。