Ivyea Jobs 5947 roles · 66 companies · 刚刚
摩尔线程 · AI 芯片

超节点产品经理

北京 社招 · 全职 其他类 产品 / 设计

职位描述

1. 超节点产品架构定义与技术前瞻 负责AI训练/推理超节点整体架构与全栈产品方案设计,主导多GPU高速互联、Scale-up/Scale-out融合组网方案选型;定义GPU拓扑、内存、散热、基板模组等核心硬件规格。跟踪CXL、光电合封等前沿技术,结合大模型算力需求,完成中长期产品技术前瞻布局。 2. 生态合作与产品量产落地 协同ODM/OEM整机厂商,基于国产GPU特性联合定义超节点整机柜量产规格,推进生态合作落地。负责核心部件方案评审、可靠性测试、安规认证与可制造性优化,保障产品从0到1量产交付。统筹供应链、BOM及版本兼容性管理,优化产品配置体系,降低客户选型成本。 3. 系统性能优化与集群验证迭代 负责超节点系统性能调优与集群瓶颈优化,支撑万卡级超大算力集群架构设计。联动头部大模型客户,基于真实业务负载迭代硬件产品特性。建立故障闭环机制,负责重大现场问题根因分析与优化,保障大规模集群稳定运行。 4. 产品商业化与生态建设 输出产品白皮书、选型指南、MRD等商业化材料,支撑客户对接与招投标项目落地。参与成本核算、定价及产品矩阵规划,平衡性能、成本、功耗与研发周期。推进各行业客户适配认证,落地标杆案例,搭建国产超节点算力生态。

任职要求

1. 硕士及以上学历,计算机、微电子、通信等相关专业, 8年以上服务器、数据中心、HPC硬件架构或产品管理经验,含3年以上AI服务器/超节点产品经验; 2.精通GPU架构,熟悉CPU、高速互联、存储等服务器核心子系统, 熟悉数据中心组网与GPU互联技术,掌握行业主流超节点架构方案; 3. 具备系统工程思维,可平衡产品性能、成本、功耗与可靠性; 4. 具备AI服务器/超节点产品从0到1完整量产落地经验。 5. 加分项 - 头部云厂商/服务器厂商超节点产品经验; - 主导过千卡级以上AI集群架构设计与落地验证; -熟悉OCP/OAM标准,具备液冷服务器项目经验; -具备互联/交换芯片产品定义经验; -熟悉国产GPU算力生态,具备相关项目落地经验。