职位描述
职位描述:
研发用于工业具身机器人的视觉-语言-动作(VLA)大模型与可交互世界模型,实现跨任务零样本泛化。
设计适合工业环境的轻量化大模型架构(蒸馏、量化、混合专家),支持边缘端实时推理。
探索基于世界模型的预测、规划与因果推理能力,提升机器人在非结构化环境中的自主性。
带领团队构建具身多模态数据集,设计预训练与微调策略。任职要求
博士,深度学习/多模态方向,3年以上大模型(如LLaVA、PaLM-E、RT-2系列)研发经验。
熟练使用PyTorch/TensorFlow,大规模分布式训练及模型部署(TensorRT,ONNX)。
有世界模型或基于模型的强化学习论文或落地项目者优先。
优秀的算法创新与工程落地平衡能力。
立即投递