职位描述1、设计和开发创新性的模仿学习和强化学习算法,应用于人形机器人场景任务,具备泛化能力 2、研究并构建具备视觉、触觉、语言等多模态感知和决策能力的大模型,实现机器人在开放世界中的物理交互。 3、优化具身算法模型结构,以支持具身算法的实现和高效运行。 4、与跨职能团队合作,推动具身算法在实际场景中的应用 5、撰写技术文档和学术论文,分享研究成果并在技术社区中展示创新技术。任职要求1、计算机视觉、多模态大模型等相关领域博士 2、精通Python编程语言,熟悉PyTorch、TensorFlow等深度学习框架 3、熟悉机器人模仿学习、强化学习理论,有相关领域有影响力的Paper者优先 4、有ACT、MT-ACT、RT1、RT2、Diffusion Policy等算法相关研究背景经验者优先 5、熟悉LLM/VLM/VLA,了解R3M、RFM、PaLM-E、OpenVLA等多模态具身大模型经验者优先 6、有实际的机器人、自动驾驶项目经验者优先。