职位描述【工作职责】 1. 参与具身智能(Vision-Language-Action, VLA)模型的前沿算法研究,探索多模态表征学习、跨任务与环境泛化、自适应控制等关键问题; 2. 设计与实现新型 VLA 模型结构,研究视觉、语言与动作在具身智能中的协同机制; 3. 在仿真环境以及真机中进行算法验证与性能评估并产出高质量研究成果。任职要求【任职要求】 1. 在具身智能、多模态学习、计算机视觉、强化学习等一个或多个方向具有深入研究或项目经验; 2. 熟悉 Linux 开发环境,具备扎实的编程能力,熟练使用主流深度学习框架(PyTorch、TensorFlow、DeepSpeed 等); 3. 了解机器人控制基础,具备机械臂项目经验者优先;熟悉轨迹规划、避障、最优控制或正逆运动学、动力学建模者优先; 4. 具备良好的科研思维与实验能力,能够独立设计实验并分析结果。 【加分项】 - 拥有扎实的机器学习与算法基础,对多模态融合、强化学习或世界模型方向有深入理解;在 NeurIPS、ICLR、ICML、CVPR、ICCV、ECCV、CoRL 等顶级会议/期刊发表论文者优先; - 具备优异的编程与工程能力,熟练掌握 C/C++ 或 Python;ACM/ICPC、NOI/IOI、TopCoder、Kaggle 等竞赛获奖者优先。