岗位描述
岗位职责(具体工作内容)
1、数据开发与ETL:参与离线/实时数据仓库的开发,编写和优化Spark SQL 任务,完成数据抽取、清洗、转换、入仓的全流程开发与调度配置。
2、数仓建模:在导师指导下参与 ODS / DWD / DWS / ADS 分层建模,理解并落地业务口径,产出可复用的明细表与汇总表。
3、需求支持:对接业务、产品、分析师的取数与报表需求,完成数据提取、指标计算与结果核对,沉淀为标准化的数据服务。
4、可视化与交付:参与看板、报表的搭建与维护,将分析结果以清晰可读的形式交付给业务方。
5、AI 数据能力建设:参与「自然语言取数」「AI 自动建模」「智能数据质检」等 AI + 数据场景的落地,包括指标/表/字段元数据的知识库整理、语义层与口径描述的结构化沉淀,为大模型提供可靠的检索上下文。
任职资格(学历、目标院校、语言、技能、性格等要求)
1、硕士在读,计算机、软件工程、数学、统计学、数据科学等相关专业;
2、可连续实习 3 个月以上(能长期实习者优先);
3、熟练掌握 SQL,具备一定的 SQL 性能调优意识;
4、掌握 Python 或 Java/Scala 中至少一门语言,能独立编写数据处理脚本;
5、有 AI 编程助手的日常使用习惯,具备基本的 Prompt 工程能力;