职位描述
1. 负责生产环境的部署、监控、维护及故障处理
2. 设计和维护 CI/CD 流水线,提升研发交付效率
3. 管理和优化云基础设施(AWS/阿里云/GCP)
4. 构建和维护容器化平台(Docker、Kubernetes)
5. 建设监控告警体系(Prometheus、Grafana、ELK)
6. 编写自动化运维脚本和工具,减少人工干预
7. 制定灾备方案,定期进行容灾演练任职要求
- 本科及以上学历,3年以上运维或 DevOps 相关经验
- 精通 Linux 系统管理(CentOS/Ubuntu),熟悉 Shell/Python 脚本
- 熟练使用 Docker、Kubernetes,有集群管理经验
- 熟悉至少一种主流云平台(AWS/阿里云/GCP),有认证者优先
- 熟悉 Jenkins、GitLab CI、ArgoCD 等 CI/CD 工具
- 熟悉 Nginx/HAProxy 负载均衡及反向代理配置
- 了解 Terraform、Ansible 等基础设施即代码工具
- 有 SRE 实践经验、具备 On-Call 经验者优先