职位描述【岗位职责】 -参与具身智能与机器人学习团队,研发具备通用泛化能力的新一代机器人基础模型。 -设计、开发、训练和优化视觉语言动作模型(VLA)及世界模型(World Model),提升机器人感知、理解、规划和执行能力。 -收集、整理、标注和生成用于模型训练与评估的数据,包括真实机器人数据、遥操作数据、仿真数据和合成数据等。 -设计评测数据和指标,策划实验,对比不同模型结构、训练策略和数据配比对模型效果的影响。 -搭建、配置并使用仿真环境和真实机器人硬件环境,验证模型在仿真及真实场景中的任务执行效果。 -将研究成果工程化,集成至实际机器人系统中,优化模型的推理速度、稳定性和任务成功率。 -跟踪 VLA、World Model、Robot Foundation Model 等领域的最新研究动态和技术趋势,持续提升团队技术水平。任职要求【岗位要求】 -计算机视觉、自然语言处理、机器学习、机器人、人工智能等相关专业的硕士或以上学历。 -两年以上深度学习、计算机视觉、多模态大模型、机器人学习或强化学习相关研究与工程经验。 -熟悉 Transformer 架构、图文多模态、LLM/VLM、VLA 以及大模型预训练和微调方法。 -熟练掌握 PyTorch 等深度学习框架,具备扎实的 Python 编程基础,熟悉 C++ 者优先。 -具备优秀的分析和解决问题能力,以及良好的团队协作和工程落地能力。 【加分项】 -熟悉常用机器人仿真环境,如 Isaac Sim/Gym、MuJoCo、SAPIEN、Gazebo 等。 -熟悉主流 VLA / World Model 架构,并在相关领域有研究或实践经验。 -具备机器人领域研究或工程经验,熟悉真实机器人数据采集、训练、评测和部署流程。 -熟悉分布式训练框架,如 FSDP、DeepSpeed、Megatron-LM 等,拥有多机多卡模型训练与性能优化经验。 -在 CVPR、ICCV、ECCV、NeurIPS、ICML、ICLR、CoRL、RSS、ICRA、IROS 等会议或期刊发表论文,或有高质量开源项目贡献经验者优先。