职位描述1、核心参与全双工语音交互系统及多模态交互系统的研发工作,聚焦语音识别、多模态交互、语音大模型等核心算法的优化迭代、性能调优及全流程测试验证,支撑机器人交互能力的核心升级; 2、跟踪并深度调研国内外语音与多模态领域前沿技术动态,主导或协助团队完成核心算法的架构设计与技术选型;探索语音技术在机器人场景下的创新应用形态与能力边界,推动技术落地价值转化; 3、参与技术开源项目共建、高质量技术论文撰写及核心专利布局工作,助力团队构建业界技术影响力,打造专业技术口碑。任职要求具备以下至少一项核心算法优化经验:语音信号处理、语音唤醒、拒识或交互意图识别、语音识别、声纹识别、语音合成、语音大模型、对话管理系统等; 扎实的语音信号处理基础,深入理解语音识别、语音大模型核心原理者优先; 1、熟悉语音技术在端侧设备上的部署和优化方法; 2、具备分布式训练经验,能够处理大规模语音数据和模型; 3、具备良好的逻辑思维、沟通协作能力和学习能力,能够独立解决问题; 4、ACM等程序设计比赛、语音/自然语言处理/多模态相关顶级会议论文或比赛获奖经历者优先考虑; 5、具有技术热情及技术信仰,较强的学习能力。