岗位描述
工作内容
1、数据开发:负责数据仓库(数仓)建设,设计并开发 ETL/ELT 数据 pipeline,保障数据准确、及时产出;
2、数据模型设计:基于业务需求进行数据分层建模(ODS/DWD/DWS/ADS),提升数据复用率与查询性能;
3、数据治理:建立数据质量监控,排查数据异常,参与元数据及数据安全管理;
4、指标体系与报表:负责核心业务指标体系的搭建与落地,开发及维护 BI 报表(如 FineBI、PowerBI、Superset 等),为业务提供可视化数据支持;
5、AI赋能:探索AI与数据工程的结合,参与AI数据链路(如特征工程、向量数据库、RAG 数据准备)的建设,利用大模型提升数据开发与分析的效率。
任职条件
1、精通SQL及性能调优;
2、熟悉 Hadoop/Hive/Spark/Flink/Kafka/DolphinScheduler 等大数据组件;
3、熟悉主流 BI 工具(如 FineBI、PowerBI、Superset 等)及指标体系设计方法论;
4、了解大模型(LLM)基础原理,有 RAG、向量数据库、LangChain 或 AI 辅助数据开发经验者优先;
5、有实时数仓(Flink+OLAP)、云原生数据平台或数据治理经验者优先。