Ivyea Jobs 5947 roles · 66 companies · 刚刚
MiniMax · 大模型

AI Infra研发工程师-FinOps 平台实习生

上海 实习 AI Infra / 训练系统

职位描述

一、岗位定位 参与建设面向公有云、私有云和 Kubernetes 的 FinOps 平台,让计算、存储、网络和 GPU 等资源的成本、 用量和利用率可追踪、可解释、可优化。 二、你将参与建设什么 云资源成本分散在不同云平台、Kubernetes 集群和业务团队中,数据口径不统一、资源归属不清晰,也很难 判断资源是否真正产生了业务价值。你将参与建设一套 FinOps 平台,让资源成本可追踪、可解释、可优 化: 1. 统一采集和处理公有云、私有云及 Kubernetes 的账单、资源和用量数据。 2. 设计成本、资源、业务和团队之间的数据模型,支持成本分摊、预算管理和配额管理。 3. 结合 Prometheus 等监控数据,分析 CPU、内存、GPU 等资源的利用率与成本效率。 4. 开发预算超支、资源闲置和异常用量检测能力,探索自动生成资源优化建议。 5. 参与后端服务、数据任务、API 和自动化工具开发,建设稳定、可复用的平台能力。 6. 与业务、算法和基础设施团队协作,将真实资源运营问题转化为可落地的技术方案。

任职要求

三、我们期望你具备 1. 计算机、软件工程、云计算、数据科学等相关专业本科或硕士在读。 2. 熟悉 Python、Go、Java、C++ 中至少一门语言,具备良好的编码、调试和测试能力。 3. 掌握基本的数据结构、算法、网络和数据库知识。 4. 了解 MySQL、PostgreSQL 等关系型数据库,能够使用 SQL 完成数据查询和处理。 5. 对云计算有基础认知,了解计算、存储、网络等资源及常见计费方式。 6. 对数据分析、资源利用率、成本优化或平台工程感兴趣。 7. 每周可实习 4 天及以上,持续 3 个月及以上。 ### 加分项 - 有后端平台、数据平台、云原生或 FinOps 相关项目经验。 - 使用过 AWS、Azure、阿里云、腾讯云等公有云,或有私有云实践经验。 - 了解云账单、成本分摊、预算管理、容量规划或资源优化。 - 熟悉 Kubernetes API、Prometheus、Grafana、消息队列或任务调度系统。 - 有数据采集、ETL、异常检测、自动化工具或开源项目开发经验。