职位描述1. 参与智能交互端到端大模型的研发,打造极致类人的全双工交互体验,方向包括多轮对话质量、交互时机判定(流式判停打断拒识等),工具调用等;支持机器人在真实场景中的多模交互落地; 2. 跟踪端到端交互模型、视听觉大模型、Parametric Expression(参数化表情/动作预测)等学术界与工业界最新进展,探索新方法并将其应用到具身机器人的交互智能场景。任职要求计算机、人工智能等相关专业硕士及以上; 扎实的机器学习/深度学习理论基础,了解主流多模大模型的基本原理和训练方法; 具备良好的编程能力,熟练掌握Python,熟悉TensorFlow、PyTorch等至少一种主流深度学习框架;对具身智能、机器人交互领域有浓厚兴趣 对具身智能、机器人交互领域有浓厚兴趣;具备快速学习和独立解决问题的能力,有良好的团队协作意识。 加分项 有交互大模型研发及实际实习应用经验者优先; 在国际顶级会议/期刊(ICASSP、Interspeech、ASRU等)发表过相关论文者优先; 在语音或机器学习相关竞赛中获得过领先名次者优先;