职位描述面向机器人与人的自然交互,研究多模态感知、人体行为理解、任务规划、动作生成和机器人执行之间的协同机制,探索机器人在真实环境中如何理解人的语言、动作和意图,并以安全、自然、可解释的方式完成交互任务。涉及: 1. 视觉、语音、人体姿态和环境信息的多模态理解; 2. 人体动作、手势、意图和交互状态建模; 3. 人类动作到机器人动作的迁移与运动生成; 4. 机器人技能学习、动作规划和真实机器人部署; 5. 面向人的任务执行、可打断交互和安全控制; 6. 具身智能系统的实验设计、数据构建与评测。 岗位既包含算法研究,也包含从数据到模型到真机部署,适合希望将人工智能方法应用于物理世界问题的学生。任职要求1. 掌握 Python,具备计算机视觉、深度学习、机器人学或控制基础中的至少一项; 2. 对机器人、具身智能、人机交互或多模态模型有兴趣; 3. 有较好的工程实现能力,能够阅读并修改开源代码; 4. 有 ROS/ROS 2、运动学、仿真平台、人体姿态估计、VLA 或机器人项目经历者优先; 5. 具备从实验现象定位问题、设计对照实验和持续迭代的能力; 6. 能接受算法、数据、系统和真实设备调试之间的交叉工作。