Ivyea Jobs 6505 roles · 88 companies · 刚刚
逐际动力 · 具身智能

多模态交互算法工程师

北京 社招 · 全职 多模态 / 视觉 / 语音

职位描述

1. 多模态交互核心研发:负责机器人多模态交互功能的开发,包括语音识别(ASR)、自然语言理解(NLU)、语音合成(TTS)、视觉感知(CV)及触觉反馈,打造自然流畅的人机对话体验。 2. 基于大语言模型(LLM)构建机器人的**任务规划(Task Planning)**系统,实现复杂指令的拆解、逻辑推理及多步骤长程任务的自主执行。 3. 设计并实现机器人的长短期记忆系统,基于记忆系统实现个性化交互,让机器人具备“持续学习”和“情感陪伴”的能力,提升用户粘性。 4. 情感计算与拟人化行为:开发环境感知与用户情绪识别算法(微表情、语调分析),设计符合机器人人形特征的拟人化交互行为,深入研究人机共情机制。 5. 端侧部署与具身落地:负责端侧AI模型(包括多模态大模型、规划模型)的量化、剪枝与部署,确保在机器人嵌入式平台上的低延迟实时响应;配合硬件团队完成Sim-to-Real(仿真到真机)的算法验证。

任职要求

1. 学历背景:计算机、人工智能、机器人、自动化等相关专业,硕士及以上学历优先。 2. 编程与工程能力:精通Python,熟悉C++,具备良好的代码规范和工程落地能力。熟悉ROS/ROS2机器人操作系统,有实际的机器人开发调试经验者优先。 3. 有AI Agent(智能体)开发经验,熟悉LangChain、LlamaIndex等框架,或有任务规划(Task Planning)、工具调用(Tool Learning)相关项目经验。 4. 多模态与机器人背景:具有语音、视觉、自然语言处理等多模态融合项目的实战经验。对具身智能(Embodied AI)有浓厚兴趣,理解感知-决策-控制的闭环逻辑。 我们提供: - 深度参与全球前沿人形机器人产品从0到1的机会; - 与顶尖机器人工程师和AI科学家共事的学习环境;
逐际动力去官方页面投递 →