职位描述岗位要求:高级算法工程师 强化学习运动控制算法开发 负责人形机器人行走、拟人步态、姿态调整、抗扰动等运动控制算法的强化学习训练与优化; 跟进机器人领域前沿算法,完成核心论文的复现、改进与内部技术验证,评估其在真实业务场景中的落地价值与增益。 必备能力 熟悉强化学习基础理论; 熟悉常见仿真平台(Isaac Sim / Mujoco 等),具备完整的“仿真训练→实机迁移”项目经验; 熟悉Python/C++编程,具备良好的工程落地能力; 有至少一个经典运动控制算法的完整复现与改进经验(AMP-PPO / Beyond-Mimic / ASAP / DeepMimic等)。 加分能力 对NVIDIA GR00T系列技术有研究或复现经验; 对SONIC框架有了解或研究兴趣; 熟悉模仿学习(Imitation Learning)、对抗学习(Adversarial Learning)或扩散策略(Diffusion Policy)在人形机器人控制中的应用; 有机械臂、双足或全尺寸人形机器人的实机调试经验;任职要求1. 计算机/电子/机器人等相关领域本科及以上学位; 2.具备良好的机器人学或控制基础,具备强化学习, 模仿学习相关基础:掌握下列算法中的一项或多项: - PPO, AMP, Beyond mimic, Groot, Sonic等。 3. 具有sim2real经验,Domain Randomization 设计经验; 4.良好的团队协作能力,学习能力,和责任心。