职位描述1、算法研发与优化 1)负责传统声音前端相关算法的研发工作,包括语音活动检测(VAD)、降噪、回声消除(AEC)、语音分离、声源定位(DOA)等。 2)负责语音唤醒算法和关键词检测算法开发,声纹和属性分类、语音事件检测等算法开发。 3)参与构建语音前端解决方案,围绕语音降噪、声纹识别等方向研发核心技术,并推动技术在实际场景中的落地应用。 4)持续跟踪业内前沿技术和方法,验证并探索新技术在业务场景中的有效性,不断提升语音前端各算法效果。 2、数据处理与挖掘 1)负责大规模语音数据集的预处理,包括数据清洗、标注、格式转换等,确保数据质量,为后续算法训练提供优质数据。 2)对语音数据进行挖掘和分析,提取有价值的信息和特征,为算法优化和模型训练提供支持。 3、工程实现与系统开发 1)负责语音信号前端处理的工程实现与系统开发,将算法量化部署工程化,确保系统的稳定性和高效性。 2)与其他团队(如后端算法团队、产品团队、硬件团队等)紧密协作,完成语音前端系统与其他模块的集成和对接,共同推动产品的研发和上线。任职要求职位要求 1、专业背景:计算机、数学、通信、声学、信号处理等相关专业,硕士及以上学历。 2、技能要求 1)编程能力,熟练掌握 C/C++、Python 等编程语言,熟悉 Linux 相关操作及 Shell 脚本。 2)熟悉深度学习框架,如 Pytorch、Tensorflow、Kaldi 等。 3)具备扎实的数字信号处理、语音信号处理基础,熟悉语音前端相关技术,如语音增强、回声消除、麦克风阵列等。 4、项目经验:有语音信号处理相关项目经验,如语音前端、语音唤醒、声纹识别等项目,有实际产品落地经验者优先。 5、论文发表:在相关国际会议或期刊(如 ICASSP、Interspeech 等)发表过学术论文者优先。 6、其他能力:具备良好的学习能力、逻辑思维能力、沟通协作能力,能够快速学习新知识和解决复杂问题。