职位描述- 研究基于视频、多模态时序数据和机器人交互数据的环境建模与未来预测; - 探索世界模型与机器人策略、强化学习和 Agent 的结合,用于规划推演、策略学习与能力验证; - 探索可交互、可控的世界模型与仿真环境,提升机器人训练、数据生成和评测效率; - 推动世界模型/视频生成在真实机器人任务中的训练、评测与应用; - 撰写技术文档和学术论文,分享研究成果并在技术社区中展示创新技术。任职要求- 本硕及以上学历,计算机科学、数据科学、机器人、人工智能等相关专业 - 精通C++/Python等编程语言,熟悉pytorch/tensorflow等主流深度学习框架,了解ROS等框架 - 熟悉3D建模和计算机图形学,熟悉基于神经网络的三维重建,如3DGS/VGGT等,有场景重建的实际项目经验者优先 - 对生成模型、视频生成、多模态时序建模或世界模型等至少一个方向有较深入理解; - 有视频生成、世界模型、机器人学习、仿真或强化学习经验者优先; - 具备较强的模型训练、实验设计和研究能力,有大规模模型训练经验者优先; - 有高质量论文、开源项目或同等研究/工程成果者优先; - 优秀的沟通与团队协作能力,能够与其他工程团队合作完成任务。