职位描述参与面向人形机器人交互的 Agent系统中大模型的开发与优化,包括对话、规划、决策等核心能力构建; 参与大语言模型/多模态模型的训练与调优流程,包括 SFT、RL等方法的落地与优化; 搭建并优化支撑 Agent 能力的大规模多模态数据处理系统,支持文本、语音、图像等数据的自动化生产、筛选与结构化管理; 设计与构建高质量训练数据,包括指令数据、偏好数据、轨迹数据等,用于提升模型在 Agent 场景下的推理与执行能力; 参与模型效果评估与分析,围绕幻觉、鲁棒性、任务成功率等关键指标进行系统性优化。任职要求本科及以上学历,计算机、人工智能、电子、数学等相关专业; 出色的问题分析和解决能力,自主探索新解决方案的能力强; 熟悉或了解大模型训练与对齐方法(如 SFT、RLHF、DPO 、GRPO、DAPO、GSPO等),对 Agent(工具调用、规划推理等)有一定理解; 关注生成式 AI、多模态交互及 Agent 技术,对推动人形机器人智能化有热情; 对数据质量有极致追求,具备敏锐的数据洞察力,能精准识别数据中的噪声、偏差、标注错误及潜在风险; 深刻理解数据质量对模型效果(如幻觉、偏见、鲁棒性)的关键影响,并能在数据处理及模型训练全流程中落实严格的质量控制标准。