职位描述
1. 主导面向机器人操作的多模态模型技术的算法研究和实际落地,通过多种模态的输入提升机器人对任务的理解规划、自然语言指令跟随、任务成功率和泛化性等能力;
2. 创造性的解决多模态模型训练、微调和部署中的问题,包括但不限于增强空间理解能力、优化自然语言指令和操作的对齐、利用强化学习提升性能、端侧高效部署等;
3. 紧跟业界前沿进展,并主动将其与业务需求相结合,推动多模态模型技术在具身领域的落地。任职要求
1. 计算机、电子信息、自动化、机械工程等和AI、机器人相关专业本科及以上学历;
2. 熟练掌握Python(PyTorch/JAX)、C++编程,拥有从问题定义到算法研发落地的全栈开发经验;
3. 熟悉多模态领域主流模型(如GPT/Gemini/DeepSeek/Qwen等),对新技术有强烈求知欲和快速理解能力;
4. 熟悉常见的模型轻量化技术,包括量化、剪枝、蒸馏等,对模型微调方法有实际应用经验;
5. 在相关学术期刊/会议(CVPR/ICCV/ICML/Neurips/ICLR等)上发表过论文者优先。