职位描述
1、负责人形机器人专属的基础模型的预训练与研究工作,探索更适合具身任务的模型架构。
2、探索多模态(视觉-语言-动作)表征的对齐与融合技术,为高层决策提供强大的特征支持。
3、推动视觉基础模型在机器人各种下游任务(如导航、操作)上的迁移与应用。任职要求
1、硕士及以上学历,计算机、人工智能、软件等相关专业;硕士3年或以上,博士1年或以上人工智能领域工作经验。
2、在深度学习基础理论和模型架构设计方面功底深厚,持续关注领域最新进展(如ViT, Diffusion, Mamba等)。
3、有大规模分布式模型训练经验,精通DeepSpeed, FSDP等训练加速框架。
4、具备强大的科研能力和创新思维,能够独立复现前沿论文并进行改进。
5、加分项:在CVPR, ICCV, ECCV, ICML, NeurIPS等顶会以第一作者身份发表过论文;有大规模数据集(如ImageNet)上的模型预训练经验。