职位描述
1. 多模态交互核心研发:负责机器人多模态交互功能的开发,包括语音识别(ASR)、自然语言理解(NLU)、语音合成(TTS)、视觉感知(CV)及触觉反馈,打造自然流畅的人机对话体验。
2. 基于大语言模型(LLM)构建机器人的**任务规划(Task Planning)**系统,实现复杂指令的拆解、逻辑推理及多步骤长程任务的自主执行。
3. 设计并实现机器人的长短期记忆系统,基于记忆系统实现个性化交互,让机器人具备“持续学习”和“情感陪伴”的能力,提升用户粘性。
4. 情感计算与拟人化行为:开发环境感知与用户情绪识别算法(微表情、语调分析),设计符合机器人人形特征的拟人化交互行为,深入研究人机共情机制。
5. 端侧部署与具身落地:负责端侧AI模型(包括多模态大模型、规划模型)的量化、剪枝与部署,确保在机器人嵌入式平台上的低延迟实时响应;配合硬件团队完成Sim-to-Real(仿真到真机)的算法验证。任职要求
1. 学历背景:计算机、人工智能、机器人、自动化等相关专业,硕士及以上学历优先。
2. 编程与工程能力:精通Python,熟悉C++,具备良好的代码规范和工程落地能力。熟悉ROS/ROS2机器人操作系统,有实际的机器人开发调试经验者优先。
3. 有AI Agent(智能体)开发经验,熟悉LangChain、LlamaIndex等框架,或有任务规划(Task Planning)、工具调用(Tool Learning)相关项目经验。
4. 多模态与机器人背景:具有语音、视觉、自然语言处理等多模态融合项目的实战经验。对具身智能(Embodied AI)有浓厚兴趣,理解感知-决策-控制的闭环逻辑。
我们提供:
- 深度参与全球前沿人形机器人产品从0到1的机会;
- 与顶尖机器人工程师和AI科学家共事的学习环境;