职位描述1、参与并落地公司 CI/CD 平台建设,以 Jenkins 为核心,配合 Helm + ArgoCD,实现从代码提交到 Kubernetes 部署的标准化交付流程。 2、负责多环境治理与泳道建设,支持开发 / 测试 / 预发 / 生产环境隔离,以及多版本并行、灰度发布与快速回滚。 3、在Kubernetes 环境中推进灰度 / 金丝雀发布能力的工程化落地,降低发布风险,提升变更安全性。 4、建设并完善 应用层全链路可观测能力,覆盖指标、日志、错误追踪与告警(如 Prometheus / Grafana / Sentry 等),提升问题发现与定位效率。 5、配合研发团队,将可观测、发布、环境治理等能力 下沉到具体项目中,推动平台能力被真实使用。 6、参与数据基础设施相关的工程支撑(如 BigQuery 相关的数据链路、监控与使用规范),提升系统可观测性与数据可用性。 7、与Dev / FE / SRE 团队协作,将已有技术方案细化为可执行的配置、脚本与流程,减少重复性人工操作。任职要求1、3 年以上运维或 DevOps 相关经验,熟悉 Linux 基础,具备基本的问题排查与定位能力。 2、有 Docker / Kubernetes 实际使用经验,理解 Kubernetes 基本资源模型(Deployment / Service / Ingress / HPA 等)。 3、使用过 Jenkins 搭建或维护 CI/CD 流水线,理解构建、发布及权限控制的基本实践。 4、使用过 Helm 和 / 或 ArgoCD 进行 Kubernetes 部署,对声明式发布和 GitOps 有基本认知。 5、熟悉国内外主流云厂商(腾讯云 / 阿里云/火山引擎/aws等),理解云上计算、网络和负载均衡的基本使用方式。 6、有一定工程意识,能将方案转化为 脚本、配置或流程文档,而不是停留在口头设计。 7、具备良好的沟通与执行能力,愿意深入业务项目。 加分项(非必须) 1、有多环境 / 多集群治理或发布流程规范化经验。 2、使用过 Prometheus / Grafana / Sentry 等可观测工具。 3、对平台工程 / DevOps 平台化有兴趣,愿意长期做基础设施建设。 4、有视频、内容平台或 AI 相关系统经验。 3、建设并维护可观测性体系(监控、日志、告警、链路追踪),基于Prometheus / Grafana / ELK 等工具,实现问题的快速发现、定位与止损。 4、与研发团队深度协作推进DevSecOps实践,规范发布与变更流程,负责生产环境稳定性保障、线上故障响应、事后复盘及系统性改进。