职位描述
你将深度参与大模型/基础模型的研发全流程,与研究员、算法工程师、Infra/平台及产品团队紧密合作,负责模型项目从目标定义、研发推进、训练评测到交付验收的完整生命周期。
这不是"排期、开会、跟进度"的传统 PM 岗——我们希望你能真正理解研发工作,把复杂、模糊、高不确定性的模型研发目标,转化为清晰可执行的项目计划,并帮团队高质量落地。
【你将负责】
1. 基础模型研发项目全生命周期管理:Pre-training、Post-training、模型能力提升、评测及重要版本交付
2. 建立模型交付与验收机制,明确版本目标、评测标准与 Done Criteria,推动问题修复与回归验证
3. 应对实验失败、训练延期、算力变化、技术路线调整等动态情况,及时识别 Blocker,推动决策而非简单催进度
4. 连接 Research / Engineering / Infra / Data / Evaluation / Product 等团队,协调跨团队依赖与资源
5. 持续优化目标管理、里程碑、信息同步、风险管理、复盘等协作机制——为研究员减负,而不是增加流程负担任职要求
✅ 有大型/复杂技术项目的端到端管理经验,能在目标模糊、变化频繁的环境中建立结构
1. 有不错的技术理解力,熟悉模型训练、数据、算力、分布式训练、Post-training、Evaluation 等基本概念(计算机/AI/数学/EE 背景加分,但不用亲自训模型)
2. 强问题拆解能力:抓主要矛盾,识别 Critical Path 与核心风险
3. 强Ownership 和结果导向:不停留在"已同步、已提醒",而是真正推动问题解决
4. 沟通友好直接,尊重专业判断,让合作方感受到支持而非压力
【加分项】
1. LLM / Foundation Model / AI Infra 相关项目经验
2. 理解 Pre-training、SFT、RL、Evaluation、Inference 研发流程
3. GPU 集群、分布式训练、数据 Pipeline 经验
4. 与 Research Scientist / Engineer 长期合作的经验