Ivyea Jobs 5948 roles · 69 companies · 刚刚
自变量机器人 · 具身智能

AI Infra产品经理

深圳 社招 · 全职 AI Infra / 训练系统

职位描述

1. 负责AI Infra平台的战略与规划,主导具身智能AI基础设施全生命周期的产品管理。紧跟全球大模型(VLM/VLA/WM)、分布式训练框架、推理引擎及算力集群的技术趋势,结合公司具身智能业务战略,定义核心产品线定位,输出具备技术前瞻性与商业落地可行性的产品路线图。 2. 主导大模型MLOps与训练工具链的建设,从0到1搭建涵盖“数据-训练-仿真评测-部署”的产品化闭环。针对具身智能多模态时序数据特性,设计标准化的数据管线;构建高效的大模型后训练工具链(覆盖SFT、DPO、RL等范式),降低算法研发门槛,支撑核心业务模型(如端到端控制模型)的高效迭代。 3. 负责全局算力管理与异构调度大盘的搭建,针对具身智能研发中异构负载特点,构建全局GPU算力管理与调度平台。设计分层差异化资源供给、弹性伸缩机制及低利用率资源回收策略,为算力调度效率与集群降本增效提供核心抓手。 4. 推动模型部署与推理加速落地,面向机器人云端接管与端侧控制的极低延迟诉求,统筹推理引擎优化与高可用部署方案设计。推进模型量化、算子优化、KV Cache等最佳实践的平台化沉淀,保障推理侧的高并发、低延迟与高服务SLO。

任职要求

1. 本科及以上学历,计算机科学、人工智能、软件工程或相关理工科专业。具备3-5年以上云计算、AI平台、算力平台、DevOps/MLOps等底层基础设施产品经理经验。 2. 对大模型训练与推理链路有极深的系统性认知。熟悉主流分布式训练框架、推理引擎原理;深刻理解IaaS/PaaS架构底座,熟悉Kubernetes、容器化技术、多机多卡调度(如Volcano)及基础云原生生态。 3. 具备主导万卡级或大规模GPU集群算力治理、多模态/大语言模型生产交付管线从0到1落地经验者优先。 4. 具备极强的系统架构思维与量化分析能力。能从全局视角梳理复杂的业务数据流转与资源分配逻辑,善于通过数据洞察(如集群利用率分析、故障辅助诊断)推动产品线演进。 5. 加分项:了解具身智能行业,对机器人底层系统(ROS/ROS2)、3D物理仿真引擎(Isaac Sim等)有基本认知;对具身智能多模态数据(视频流+传感器力矩等)的对齐与特征处理有经验者优先。 6. 具备极强的Owner意识与抗压能力,在动态演进的创业环境中,既能坚守平台标准化的底线,又能灵活响应商业化交付(SaaS/私有化部署)的需求碰撞,高效推动跨部门复杂项目落地。 --- 岗位价值 通用人工智能(AGI)的繁荣发展,正推动着智能体从数字世界向物理世界跨越。具身智能作为下一代颠覆性交互形态,对底层的算力调度、多模态模型演进以及软硬协同提出了前所未有的挑战与机遇。在这里,你将深度参与并主导具身智能底层AI Infra的建设,打造连接核心算法与物理硬件的“造物引擎”,直接影响和加速具身智能行业的工业化落地进程。