岗位描述
岗位职责
负责公司全球多云基础设施的日常运维,覆盖计算、容器(K8s)、云存储、云网络等基础云服务,及时响应、分析和处理各类故障,保障基础设施稳定运行。
负责云上网络的配置与运维(VPC、子网、企业路由 ER、VPN 通道、负载均衡、NAT、安全组、云联网/云企业网等),保障跨云、跨区域业务网络的连通与稳定。
参与运维自动化建设,用 Python/Shell 等脚本解决配置管控、容量巡检、故障处理等问题,提升运维效率。
参与基础设施高可用与容灾能力建设,配合做故障演练、监控告警、故障定位与恢复。
与云厂商技术支持及研发、架构等部门协同,持续优化基础设施可靠性。
岗位要求
计算机相关专业,本科及以上学历,3 年以上互联网企业基础设施/云运维相关经验。
了解二层、三层网络基本原理,熟悉 TCP/IP、HTTP、gRPC 等常用协议;
熟练掌握华为云、腾讯云、火山引擎、阿里云等主流公有云的网络与基础产品,能独立完成 VPC、企业路由 ER、VPN 通道、负载均衡、NAT、安全组、云联网等的配置与故障排查;有多云组网经验者优先。
熟悉云原生技术栈,具备 K8s、云存储等运维经验(必备);有 Istio 等服务网格经验者优先。
掌握 Python、Shell 等脚本语言,能独立开发运维小工具;熟悉 Go 者优先。
具备强主动性、乐于学习和拓展新领域,能承接多类型运维任务而非局限单一方向;逻辑清晰、抗压、责任心强、跨部门沟通协作好。