职位描述职位概述: 作为具身智能 AI 云平台产品团队成员,参与 GPU 开发机、GPU 训练集群、具身智能训练平台及高性能文件系统等云产品的规划与设计。通过用户调研、需求分析、产品流程设计和项目协同,持续优化模型开发、训练、实验管理及数据管理体验。该岗位需要具备良好的逻辑分析能力、产品意识和技术理解力,能够与算法、研发、运维及业务团队协作,推动产品方案落地。 主要职责: 1. 产品需求分析:面向算法工程师、机器人研发人员等用户开展需求调研,梳理模型开发、数据处理、分布式训练、实验管理及模型交付等核心场景。 2. 产品流程设计:负责云平台核心业务流程、用户操作路径和异常处理机制的设计,输出用户故事、流程图、产品原型及产品需求文档。 3. GPU 开发机设计:参与 GPU 开发机的创建、配置、启停、镜像管理、环境管理、远程连接、资源监控及计费等功能设计。 4. GPU 训练集群设计:参与 GPU 资源池、训练任务提交、队列与调度、分布式训练、任务监控、日志查看及故障处理等产品功能设计。 5. 训练平台设计:参与类似 MLflow 的实验管理平台设计,包括实验记录、参数与指标追踪、训练产物管理、模型版本管理及结果对比等功能。 6. 存储产品设计:参与高性能文件系统的产品设计,梳理数据上传、挂载、共享、权限、容量管理、性能监控及数据生命周期等流程。 7. 项目协同:与算法、研发、测试、运维和设计团队紧密合作,跟进需求评审、研发排期、测试验收和产品上线,推动项目按计划交付。 8. 产品运营与优化:收集用户反馈并分析产品使用数据,定位使用障碍和流程问题,持续优化平台易用性、资源利用效率及用户体验。 9. 行业研究:跟踪具身智能、AI 基础设施、GPU 云服务及机器学习平台的发展趋势,分析主流产品和开源方案,形成竞品分析及产品建议。 10. 产品文档建设:协助编写产品使用手册、功能说明、培训材料及内部知识库,降低平台使用门槛。 任职要求: 1. 教育背景:本科及以上在读,计算机、软件工程、人工智能、自动化、机器人、信息管理等相关专业优先。 2. 产品能力:具备良好的逻辑思维和需求分析能力,能够使用 Figma、Axure、墨刀等工具完成流程图和产品原型。 3. 技术理解:对云计算、GPU、容器、分布式训练、机器学习或存储系统有基础认知,愿意深入理解技术原理和用户场景。 4. 沟通能力:具备良好的书面表达、沟通协调和跨团队协作能力,能够准确整理需求并推动问题解决。 5. 工作习惯:认真细致,责任心强,具备较强的学习能力和自驱力,能够适应快速迭代的工作节奏。 6. 实习要求:每周可实习4天及以上,连续实习3个月及以上,能够长期实习者优先。