职位描述
岗位名称
VLA 算法工程师
Vision-Language-Action Algorithm Engineer
岗位职责
负责 Vision-Language-Action(VLA)模型算法的设计、训练与优化,提升模型在复杂场景中的感知、理解与行动能力。
构建和改进 多模态表示与对齐机制,实现视觉、语言与动作空间的高效融合。
研究并实现 基于任务目标的策略学习与推理算法,支持长时序、多步骤任务执行。
参与 VLM / LLM 与控制策略的结合,探索语言引导、任务规划与动作生成的一体化方法。
设计 训练数据与标注形式(如轨迹数据、指令-动作对、成功/失败样本),提升数据效率。
在仿真与真实环境中对算法进行验证与评估,分析失败案例并持续迭代。
与强化学习、感知、系统和机器人控制团队协作,推动算法在真实系统中的落地。
跟踪并复现前沿研究(Embodied AI、VLA、Robot Learning、多模态大模型),并将研究成果工程化。任职要求
计算机科学、人工智能、机器人、自动化等相关专业硕士及以上学历(优秀本科可放宽)。
扎实的 深度学习与多模态建模基础,理解视觉、语言与动作联合学习的核心问题。
熟悉 VLM / LLM / Transformer 等模型结构及其训练方法。
具备良好的 Python 编程能力,熟悉 PyTorch 等深度学习框架。
对 机器人学习、具身智能或决策算法有实际项目经验或强烈兴趣。
具备良好的实验设计、结果分析与技术表达能力。
立即投递