岗位描述
岗位职责:
负责各公有云(GCP/AWS/阿里云)多云网络架构设计与运维: 包括各云网络、服务器和存储等,确保其安全、高可用和可扩展;
保障云主机、网络和存储等基础服务稳定性,主导监控告警、故障闭环、容量与性能调优。
落地各云安全最佳实践与合规要求(ISO/PIC DSS),执行权限、网络和资源访问控制等;
基于 Terraform 推动基础设施代码化(IaC),用 Python / Go 构建自动化工具链。
运用 AI 工具与 Agent 提升运维效率:把高频重复操作沉淀为 AI 辅助流程或 Agent,推动团队 AI 协同的标准化与最佳实践输出。
担任跨团队项目的 Ops 统一对接人,端到端网络与基础设施侧方案与交付。
主导云资源利用率优化与成本治理。
岗位要求:
统招本科及以上学历,5年以上运维相关工作;具有3年以上公有云大规模资源的运维和实践管理经验;
精通至少两家主流公有云(AWS / 阿里云/GCP)
扎实的网络基础(TCP/IP、BGP、DNS、负载均衡),熟悉 Linux、K8s、常用中间件。
熟练使用 Terraform 等 IaC 工具,掌握 Python / Go / Shell 至少一门。
AI 协同能力:
熟练使用 AI 编码工具(Claude Code / Copilot 等)高效产出 IaC、脚本、文档;
能将 AI 应用到日志分析、故障定位、变更评审、安全策略审查等真实运维场景;
具备基本的 Prompt 工程能力,懂得在使用 AI 工具时规避敏感信息泄露与合规风险。
具备端到端交付能力与跨团队推动能力,沟通顺畅,对线上稳定性有敬畏感。
具有服务意识,善于思考,积极主动、认真负责、具有高度责任感和敬业精神