职位描述1.负责机器人具身操作任务的强化学习算法设计、开发和优化; 2.研究多模态学习方法,结合视觉、触觉、力反馈提升机器人决策能力; 3.开发任务规划与控制策略,解决复杂任务分解和长时间规划问题; 4.优化从模拟到现实(Sim2Real)的迁移技术,提升算法鲁棒性; 5.跟踪前沿技术,进行强化学习算法的调研、性能对比和评估; 6.根据需求完成算法开发与代码维护,协助测试团队优化算法性能。任职要求1.硕士及以上学历,人工智能、计算机、机器人学等相关专业; 2.掌握强化学习理论,熟悉 PPO、DQN、SAC 等主流算法; 3.精通 Python,熟悉 PyTorch 或 TensorFlow 等深度学习框架; 4.熟悉 Mujoco、Isaac Gym、PyBullet 等机器人仿真工具; 5.熟悉LLM/VLM/VLA,了解RT-1/2、OpenVLA等多模态具身大模型经验者优先; 6.在顶会发表论文或具备 机器人 项目经验者优先; 7.工作积极主动,具备良好的团队合作与问题解决能力。