岗位描述
岗位职责
1.参与云平台(华为云/阿里云/私有云) IT 高可用性架构设计。
2.负责业务系统的版本发布、环境部署、日常巡检和运维,保障系统的稳定性。
3.构建自动化运维休系,设计并开发应用部署流水线,推动 Ansible / Terraform /k8s落地。
4.构建完善的可观测体系,基于 Prometheus / Grafana / Skywalking / ELK 等实现及时故障分析预计能力。
岗位要求
1.全日制博士研究生,计算机、软件工程等相关专业。
2.熟悉Linux运维,熟练掌握操作系统、网络、安全、存储、IO基础知识,掌握问题排查、性能分析方法和工具。
3.具备Shell、Python、golang等一种或多种开发经验,有Java或C++开发经验更佳。
4.熟悉华为云、阿里云等主流公有云厂商的产品体系。
5.掌握Kubernetes集群的基本工作原理与相关主要插件,能够独立负责Kubernetes集群的管理和维护工作,能够分析处理常见的容器集群故障。