Ivyea Jobs 5948 roles · 69 companies · 1 小时前
生数科技 · AI 应用

模型评测专家 (音频)

北京 社招 · 全职 多模态 / 视觉 / 语音

职位描述

1、面向音视频生成模型中的音频与声画表现,搭建评测体系,持续评估内部模型在听感、音质、声画同步与可用性上的表现,跟踪行业主流产品,输出可指导算法迭代与产品决策的结论; 2、评测基准搭建:设计并维护音视频生成模型的音频相关评测基准,重点评测:指令遵循、音质与听感、音色一致性、声画同步、混音平衡与空间感,以及情绪匹配、声音叙事表达等专业维度; 3、模型评测与行业对比:基于评测基准,开展内部模型迭代测试,并对比可灵、Seedance等主流 AIGC 产品,分析音频效果、声画一体表现、可控性、稳定性与生产可用性差异; 4、用例与问题归因:设计分层与边界用例(对白清晰度、音效事件对齐、BGM 与情绪匹配、噪声/失真、长时序音色漂移、复杂声场等);建立失败模式分类,定位音质劣化、音色不稳、不同步、情绪错配、指令偏离等问题,区分模型能力与提示/参数因素; 5、报告与决策支持:输出结构清晰、结论可复现的评测报告,给出模型优化建议,支撑版本迭代与业务决策; 6、体系持续迭代:跟踪音视频生成技术与行业需求变化,持续优化评测维度、权重与用例,提升评测效率与结论可信度。

任职要求

1、本科及以上,录音艺术、音乐制作、音频工程、声音设计、数字媒体等相关专业优先。影视漫剧/广告电商/泛互工作背景优先; 2、有可灵、Seedance、TapNow、LibTV 等 AIGC 工具实际使用经验,能比较不同产品在音画表现与可控性上的差异; 3、具备专业听音与声音审美能力,能对以下维度做稳定、可解释的判断:指令遵循-声音结果是否准确响应提示词与控制条件,音质与听感-清晰度、噪声、失真、自然度等,一致性-音色、响度、风格在时序上是否稳定,声画同步-对白、音效、音乐与画面事件是否对齐,声音表达-混音平衡、空间感、情绪匹配与叙事支撑 同时具备基础画面可用性判断能力,能参与视听一体评测; 4、对生成质量高度敏感,逻辑清晰,沟通顺畅,能独立完成评测文档与报告,客观严谨,对评测结论负责;学习快,能持续跟进新产品与新能力; 5、加分项:有听评、评测标准设计经验,有配音、音效设计、音乐制作、混音等相关项目经验,有 AI 工作流、提效工具使用经验。