职位描述- 参与具身智能基础模型研发,提升模型在不同任务、场景和机器人本体上的通用性与泛化能力。 - 研究视觉、语言、视频、动作等多模态信息的统一建模,探索理解、生成与行动一体化的基础模型。 - 探索具身数据配方与 Scaling Law,研究数据规模、数据组成与模型能力增长之间的关系。 - 推进大规模预训练、模型迭代与真实机器人验证,持续提升模型能力上限。 - 与世界模型、Agent、强化学习等团队协作,推动研究成果形成模型能力、论文或开源项目。任职要求- 硕士及以上学历,计算机、人工智能、机器人、机器学习等相关方向,具备扎实的深度学习基础和良好的代码能力。 - 对 VLM、VLA、多模态基础模型、生成模型等至少一个方向有较深入理解。 - 有大规模预训练、多模态学习、机器人学习或跨任务 / 跨本体泛化经验者优先。 - 具备较强的研究能力,能够独立完成问题分析、实验设计与模型迭代。 - 有高质量论文、开源项目或同等研究 / 工程成果者优先。