Ivyea Jobs 5948 roles · 69 companies · 刚刚
深势科技 · AI for Science

SRE工程师

深圳 / 北京 社招 · 全职 AI Infra / 训练系统

职位描述

1.Site Reliability Engineer,负责业务系统及各类在线服务可靠、稳定、高效运行; 2.设计研发服务运维解决方案,包括故障分析、弹性计算、容量管理、性能调优、持续交付; 3.精细化数据运营,包括可用性指标、历史事故、资源利用率等,挖掘系统薄弱点,落地改进项目; 4.积累运维最佳实践,为业务架构设计与组件选型提供指导,输出运维技术文档。

任职要求

1.统招本科及以上学历,3年以上相关工作经验,熟悉Linux系统,有计算机体系结构及网络方面的知识; 2.有Docker、Kubernetes等容器运维经验; 3.熟练掌握Go/Shell/Python至少一种编程语言; 4.强烈的责任心、进取心、团队合作精神和Ownership
具有以下条件者优先: 5.具有阿里云、AWS、腾讯云等云平台维护经验者优先。