职位描述岗位职责 参与实时多模态交互核心功能的开发与测试。 接入和调试端到端大模型、Realtime API 协议设计与实现 等服务。 参与上下文管理、工具调用、任务编排和状态管理能力建设。 协助实现 VAD、对话判停、拒识和打断等交互能力。 编写单元测试与集成测试,复现并定位时序、并发和链路问题。 参与机器人或开发环境中的联调和效果验收。任职要求任职要求 计算机、人工智能、自动化、软件工程等相关专业在读。 做过多模态相关项目,理解上下文、工具调用和任务编排等基本概念。 了解异步编程、WebSocket、流式接口或事件驱动系统中的至少一项。 能够使用 Git、Linux及常见调试工具。 有测试意识,愿意通过实验和数据验证结论。 学习能力强,能够主动拆解和推进技术问题。 加分项 使用过 OpenAI Agents SDK、ADK、Livekit agent、Pipecat、Agentscope 或类似 Agent 框架。 接触过 Realtime API、流式语音交互或 WebRTC。 熟悉 VAD、ASR、PCM 音频或基础音频处理。 有机器人、智能硬件或嵌入式 Linux 项目经验。 使用过 ONNX Runtime、TensorRT 或其他端侧推理工具。 有开源项目、技术博客、竞赛或可演示的个人项目。 们希望你 不满足于“模型能够返回结果”,愿意继续追踪时延、错误和边界情况。 能清楚说明自己做过的项目,以及其中真正由自己完成的部分。 遇到不确定的问题时,能够提出假设并设计验证方法。 对实时多模态交互和机器人方向有长期兴趣。 你将获得 参与真实机器人交互闭环系统从骨架到落地的完整经历。 深入接触实时音视频交互、联合Agent 工程化及端侧部署。 在导师指导下负责可以独立验收的功能模块。 表现优秀者可获得转正机会。