职位描述
1、监控系统和基础设施的运行状态,及时发现并解决问题和故障。
2、配置和管理服务器、网络设备和存储设备等基础设施,确保其正常运行和高可用性。
3、部署和维护系统软件和工具,确保其安全性和稳定性。
4、制定和执行系统备份和恢复策略,确保数据的安全性和完整性。
5、与开发团队紧密合作,提供技术支持和指导,解决系统性能和可靠性方面的问题。
6、跟踪系统运行指标和日志,分析和优化系统性能。
7、参与制定和执行系统的容量规划和扩展策略,以支持业务的增长和变化。
8、提供紧急故障处理和系统支持,确保系统的持续可用性。
9、文档化系统配置和操作手册,以便于团队成员的参考和使用。任职要求
1、本科及以上学历,计算机科学、信息技术或相关专业优先考虑。
2、5年以上运维工程师或系统管理员的工作经验,熟悉系统运维和基础设施管理的流程和方法。
3、熟悉常见的操作系统(如Linux、Windows)和网络设备的配置和管理。
4、具备良好的故障排除和问题解决能力,能够快速定位和解决系统故障和性能问题。
5、熟悉常见的系统监控和日志分析工具,能够有效地监控和分析系统运行状况。
6、具备良好的学习能力和适应能力,能够快速掌握新的技术和工具。
7、具备良好的沟通和团队合作能力,能够与开发团队和其他利益相关者进行有效的沟通和协作。
8、具备良好的时间管理和组织能力,能够有效地管理多个任务和优先级。
加分项:
1、有云平台(如AWS、Azure)或容器技术(如Docker、Kubernetes)的使用经验。
2、对自动化运维工具和配置管理工具(如Ansible、Chef、Puppet)有一定了解和实践经验。
3、具备相关认证,如RHCE、CCNA等。