职位描述
工作职责:
1.负责服务器与应用的全生命周期运维(规划、监控、备份、日志分析、故障排查、性能调优),结合AI大模型优化运维流程,保障业务稳定高效运营;
2.负责云机房、负载均衡网络架构设计,通过运维开发提升架构可扩展性与自动化水平;
3.负责前沿开源技术、网络安全产品的测试选型,结合AI运维工具优化落地效果;
4.负责Linux系统、MySQL数据库及公有云平台(阿里云、AWS等)运维,通过脚本/工具实现运维自动化;
5.配合新项目环境搭建与部署自动化,沟通技术方案并提出架构优化建议;
6.开发运维工具、脚本及平台,落地AI大模型在运维中的应用(异常检测、故障预测等),优化运维效率与响应速度;
7.参与运维流程制定与规范优化,确保运维工作高效可追溯。任职要求
任职资格:
1.3年以上互联网运维开发经验,有大型云平台运维开发经历,具备AI大模型应用于运维流程的实战经验;
2.精通Linux系统运维(架设、内核优化、安全加固),熟悉Lamp/Lnmp架构,能通过脚本实现系统自动化运维;
3.具备T级以上MySQL数据库运维优化经验,熟悉高并发、高存储场景;
4.熟悉NoSQL、分布式存储(Hadoop等),能结合开发技术实现存储运维自动化;
5.熟悉IDC分布设计,能设计机房数据分布、容灾备份方案并通过开发手段落地;
6.精通负载均衡、DNS、虚拟化技术,熟练掌握Docker容器化部署与K8S集群运维,能开发工具实现自动化;
7.具备扎实的开发能力,精通Python、Shell脚本,熟悉Ansible、Jenkins、K8S、Prometheus等工具的集成与二次开发。
加分项:
1.有语音识别、语义理解等AI相关业务的运维开发经验;
2.具备完整运维架构设计与开发经验,能覆盖从底层硬件到上层应用的全流程运维开发;
3.熟悉多家公有云平台,能开发工具实现多云统一运维;
4.有AI大模型智能运维落地经验(故障预测、日志智能分析等),熟悉AI运维框架。