岗位描述
职位描述
1、使用 SQL、Python、Spark/Flink 开发数据处理任务,完成数据清洗、转换、加载,实现业务系统数据入湖
2、规划 ODS、DWD、DWS、ADS 各层数据模型,进行维度建模设计,保障数据一致性
3、开发和维护离线、实时数据处理任务,保障数据按时产出
4、制定数据质量检查规则,定位处理数据异常
5、参与公司数据资产分层开发与落地,配合业务域梳理
6、支持业务部门完成指标体系开发和落地,维护指标字典
7、参与语义层和知识图谱设计,为 AI 应用提供数据支撑
任职条件
1、本科及以上,计算机、软件工程、数据科学相关专业
2、5 年以上数据仓库或数据平台开发经验,有从 0 到 1 主导数据中台 / 数仓建设经历
3、SQL 熟练,能在 Oracle、MySQL、PostgreSQL 写复杂查询和存储过程,有性能调优经验
4、熟练使用 Python 做数据处理,会 PySpark 或 Flink
5、精通数仓分层架构和维度建模,能独立设计分层数据模型
6、熟悉指标管理和指标计算,能独立设计指标体系
加分项:
1、有制造业、半导体、汽车行业数据中台建设经验
2、做过湖仓一体,用过 Iceberg/Hudi/Paimon
3、用过 dbt、PowerDesigner、Erwin
4、做过语义层或图数据库(Neo4j)
5、用过 FineReport、FineBI 等报表工具