Ivyea Jobs 10706 roles · 176 companies · 刚刚
清微智能 · AI 芯片

音频算法工程师(多模态方向)

北京 校招 · 全职 AI软件研发&算法类 多模态 / 视觉 / 语音

职位描述

1、负责音频/语音信号处理算法的研发与优化,包括但不限于:语音增强(降噪/去混响/回声消除)、麦克风阵列信号处理、语音唤醒/识别等; 2、参与 AIGC音频生成 方向的研究与落地,包括但不限于:语音合成(TTS)、语音克隆等,跟进前沿大模型并探索在业务场景中的应用; 3、参与多模态音频理解方向的研究与落地,包括但不限于:音频事件检测与场景识别、音视频联合分析(视觉-音频跨模态对齐)、音频表征学习、声音异常检测等,支持公司在视频内容理解、智能监控、多模态大模型等业务场景中的音频理解需求; 4、负责音频算法在嵌入式端/移动端/云端的工程落地与性能优化,包括模型轻量化(量化/剪枝/蒸馏)、推理加速等工作。

任职要求

1、硕士及以上学历,计算机、信号处理、声学、电子工程、自动化、人工智能等相关专业; 2、扎实的编程基础,熟练掌握 Python/C++,熟悉Linux开发环境; 3、深入理解数字信号处理基础理论,熟悉语音/音频信号处理常用算法; 4、熟练掌握主流深度学习框架(PyTorch/TensorFlow),有实际模型训练、调优经验; 5、熟悉主流音频特征(MFCC、FBank、Spectrogram等)及音频数据预处理流程; 6、有独立完成音频算法相关科研或工程项目经验(课题/实习/竞赛/开源贡献)。
清微智能去官方页面投递 →