Ivyea Jobs 5948 roles · 69 companies · 刚刚
自变量机器人 · 具身智能

语音工程化工程师(机器人端侧)

深圳 社招 · 全职 多模态 / 视觉 / 语音

职位描述

1. 主导机器人端侧音频处理业务模块的需求分析、技术方案设计及核心代码开发,保障音频系统的稳定性与可扩展性; 2. 负责AEC(回声消除)、DOA(声源定位)、ANS(降噪)等音频前端算法在端侧的移植、适配、性能调优及持续迭代; 3. 负责打通机器人端侧、云端、模型端及移动端,构建全链路音频数据流,负责端到端的性能监控、延迟优化、异常诊断及体验提升; 4. 负责语音相关模型(如ASR/TTS/VAD/KWS等)在端侧硬件上的本地化部署、推理加速及日常维护,确保模型在资源受限环境下的实时性与准确率; 5. 与算法团队、系统团队紧密配合,推动语音工程化问题的闭环解决,并参与制定端侧音频开发规范。

任职要求

1. 本科及以上学历,计算机、电子、通信等相关专业,3年及以上Linux应用软件开发经验; 2. 精通C++/Python,具备扎实的面向对象编程思想,拥有复杂工程代码的维护、重构及疑难问题定位能力; 3. 熟悉Linux系统编程,熟练掌握多线程、异步编程及网络通信机制;熟悉Docker容器化部署者优先; 4. 深入理解音频编解码原理,熟悉采样率、音频帧、Buffer管理、实时播放等底层音频处理机制; 5. 熟悉ASR、TTS、VAD、KWS等主流语音技术原理及工程化落地流程; 6. 具备ARM64或嵌入式Linux平台的开发与部署经验,熟悉底层音频驱动(如ALSA)者优先; 7. 具备良好的系统设计思维、跨团队沟通协作能力以及问题闭环推动能力。 加分项: 1. 熟悉ROS2机器人操作系统,有机器人语音交互项目实战经验者优先; 2. 熟悉WebRTC音频处理框架者优先; 3. 具备NVIDIA Orin等边缘计算平台的开发经验,或有端侧模型推理加速(如TensorRT、ONNX Runtime等)经验者优先。