职位描述1、强化学习算法研发:围绕机器人在强化学习,模仿学习与逆强化学习等开展前沿技术研究工作; 2、强化学习后训练:探索真机强化学习在具身大模型后训练领域的应用和算法突破,提升机器人完成复杂灵巧任务的能力; 3、效率提升:提升真机强化学习的样本利用率,探索多智能体强化学习和分布式真机后训练在具身领域的应用;任职要求任职要求: 1、研究生及以上学历,计算机、AI、Robotics等相关专业优先; 2、扎实的深度学习、强化学习基础(Model-based/Free RL、Online/Offline RL、Imitation learning),对机器人多模态、端到端运动操作、多指灵巧操作、Sim2real等有研究深度; 3、优秀的分析和解决问题能力,自驱性强,具备良好的团队协作素质; 4、算法和编程基础扎实,有机器人仿真、真机调试经历者优先; 5、在ICML/NeurIPS/ICLR/ICRA/RSS等顶会论文发表论文或参加过国际竞赛并获得成果的同学优先。