职位描述
1、负责音频/语音信号处理算法的研发与优化,包括但不限于:语音增强(降噪/去混响/回声消除)、麦克风阵列信号处理、语音唤醒/识别等;
2、参与 AIGC音频生成 方向的研究与落地,包括但不限于:语音合成(TTS)、语音克隆等,跟进前沿大模型并探索在业务场景中的应用;
3、参与多模态音频理解方向的研究与落地,包括但不限于:音频事件检测与场景识别、音视频联合分析(视觉-音频跨模态对齐)、音频表征学习、声音异常检测等,支持公司在视频内容理解、智能监控、多模态大模型等业务场景中的音频理解需求;
4、负责音频算法在嵌入式端/移动端/云端的工程落地与性能优化,包括模型轻量化(量化/剪枝/蒸馏)、推理加速等工作。任职要求
1、硕士及以上学历,计算机、信号处理、声学、电子工程、自动化、人工智能等相关专业;
2、扎实的编程基础,熟练掌握 Python/C++,熟悉Linux开发环境;
3、深入理解数字信号处理基础理论,熟悉语音/音频信号处理常用算法;
4、熟练掌握主流深度学习框架(PyTorch/TensorFlow),有实际模型训练、调优经验;
5、熟悉主流音频特征(MFCC、FBank、Spectrogram等)及音频数据预处理流程;
6、有独立完成音频算法相关科研或工程项目经验(课题/实习/竞赛/开源贡献)。