锦鲤求职

昊华科技

科研数据管理科学家

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

工作内容
在生物信息学组内部主导并执行生物数据系统与计算基础设施的管理、集成与架构设计,全面支持中国种业研发(Seeds R&D)。该岗位负责对多样化的高通量生物实验数据进行结构化整理、存储和治理,并在高性能计算(HPC)集群与现代云环境中统一管理分析代码库。通过与生物信息学家、性状发现科学家、功能基因组学团队及数字化合作伙伴紧密协作,优化数据流向,构建高扩展性的存储解决方案,并确保高性能计算系统具备稳健的架构,以加速数据驱动的作物生物技术研发。

• HPC 与云平台运维 (HPC & Cloud Platform Operations)
1、管理、配置并优化高性能计算(HPC)集群环境与云数据仓库,确保大规模生物数据集的顺畅存储、检索与分析。监控系统性能、计算资源以及数据存储成本,最大化提升资源利用率。

• 生物数据与代码全生命周期管理 (Biological Data & Code Lifecycle Management)
2、系统化地管理、管理/清洗(Curate)及版本化生物实验数据(如基因组学、RNA-seq等数据),以及配套的生物信息学软件、脚本和分析流程(Pipelines)。为科研团队建立标准化的代码仓库、版本控制工作流及文档最佳实践。

• 分析流程支持与系统集成(Pipeline Support & Integration)
3、与生信流程开发人员、数据科学家及实验研究团队紧密合作,精简与规范数据摄入、预处理和自动化分析工作流。确保来自多组学平台和实验分析的原始数据能够无缝传输、校验并格式化,以供后续分析使用。

• 跨职能协作与技术培训(Cross-Functional Collaboration & Technical Training)
4、与本地及全球 IT、AI 工程和生物信息团队协作,统一数据存储与计算标准。为科研人员提供关于数据提交规范、云端使用、HPC 任务调度及脚本版本控制等方面的培训与技术支持。持续评估新兴的云存储解决方案、分布式计算框架及数据库架构(如 Snowflake、AWS 云原生服务、图数据库等),推动先正达生物数据基础设施现代化,保持技术领先优势。

任职条件
1、生物信息学、计算生物学、计算机科学、数据工程、信息技术或相关定量学科(Quantitative Discipline)的硕士或博士学位。
2、具备在高通量数据管理、HPC 集群或企业级云数据架构方面的经验:博士学历需 3 年以上经验,硕士学历需 5 年以上经验(学术界或工业界研发环境均可)。
3、具有大规模数据集管理、数据管道(Data Pipeline)构建及代码仓库架构搭建的成功实践经验。
4、具备在云基础设施(Snowflake 或同等平台)上开展工作的实操经验。
5、拥有农业、生物技术、生命科学或相关研发密集型行业背景者优先考虑。
6、熟练掌握现代数据存储、数据仓库及云计算平台相关知识(如 AWS S3/EC2、Snowflake 或同等企业级系统)。
7、深度熟悉 Linux/Unix 操作系统、高性能计算(HPC)集群环境(如 Slurm、SGE)及任务调度机制。
8、理解数据库系统(SQL)及用于管理结构化与非结构化数据的数据工程工作流。
9、了解常见高通量生物数据类型。具备植物生物学、生物技术研究及生物实验流程背景者优先。
10、精通 Python、Bash/Shell 脚本及 SQL,遵循良好的软件开发最佳实践(如版本控制、容器化、文档规范。
11、具备在 HPC 集群服务器与现代云平台(如 AWS、Snowflake)之间架构、迁移及优化数据工作流的能力。
12、具备出色的问题解决能力,注重数据治理、数据完整性及计算科研的可复现性。
13、能够清晰有效地向实验科学家及非技术背景的相关方沟通复杂的专业技术、云架构及计算基础设施概念。
14、具备在生物信息、软件工程及实验室团队之间建立高效跨职能协作的实证能力。
15、优秀的英语口语表达与书面写作能力(工作语言)。

数据方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →