岗位描述
岗位职责:
1、负责企业数据仓库整体架构设计、搭建及⽇常维护⼯作,全程参与数据采集、清洗、转化、加⼯、
分层建模及应⽤层数据开发⼯作,保障数仓体系稳定运⾏。
2、主导数据仓库分层架构、业务主题域、维度模型及核⼼指标体系的规划与建设,统⼀全域数据⼝
径,规范数据产出标准,提升数据⼀致性与可⽤性。
3、负责离线数据任务的开发、配置调度、⽇常运维、故障排查及性能调优,搭建完善的数据质量监控
体系,开展数据质量治理、异常修复、批量补数等⼯作,保障数据产出准时、准确、稳定。
4、参与实时数据链路搭建与实时数仓建设,基于Kafka、Flink等主流实时组件,完成实时数据接⼊、
清洗、计算及落地开发,⽀撑业务实时数据需求。
5、负责AI数仓知识库的搭建、迭代与⽇常维护,沉淀标准化的数仓模型、指标⼝径、数据字典、开发
规范及最佳实践,赋能智能问数、数据资产检索等智能化数据应⽤场景。
6、深度对接业务、产品及数据分析团队,承接各类数据需求,完成需求拆解、可⾏性分析、⽅案设计
及落地交付,⽀撑业务分析、数据决策与业务迭代优化。
任职要求:
1、本科及以上学历,计算机、⼤数据、软件⼯程等相关专业,拥有3年及以上⼤数据数仓开发实战经
验。
2、扎实掌握数据仓库核⼼理论,熟悉数仓分层设计、维度建模、主题域划分及指标体系搭建⽅法论,
具备独⽴的数仓建模与体系规划能⼒。
3、精通SQL,熟练编写复杂查询、聚合、关联逻辑,能够独⽴完成SQL开发、慢查询优化、数据问题
排查与性能调优。
4、熟练使⽤MaxCompute、Hive、Spark等主流⼤数据计算引擎及数仓平台,具备成熟的⼤数据离线
开发能⼒。
5、熟悉ETL/ELT全流程开发规范,具备丰富的任务调度、运维监控、数据补数、数据质量治理实战经
验。
6、了解Kafka消息队列、Flink实时计算技术,能够独⽴完成常规实时数据任务的开发与运维⼯作。
7、具备良好的需求理解能⼒、逻辑思维能⼒、问题排查能⼒与跨团队沟通协作能⼒,⼯作严谨负责,
具备较强的落地执⾏⼒。
优先条件1、具备Java后端开发经验,熟悉Spring Boot、MyBatis等主流开发框架,有数据平台开发经验者优
先。
2、熟练掌握Flink SQL、DataStream API,具备完整的实时数仓项⽬落地经验者优先。
3、熟练使⽤阿⾥云⼤数据⽣态平台,有MaxCompute、DataWorks等平台实操及项⽬经验者优先。
4、有AI数据赋能相关项⽬经验,熟悉知识库搭建、RAG、Text-to-SQL、⼤模型⾏业应⽤开发经验者优
先。