岗位职责:
负责 TTS 模型音频评测,重点评估发音准确性、音质、自然度、韵律、情绪表现、音色一致性、长文本稳定性等维度。
参与 TTS 评测集建设,覆盖通用文本、长文本、中英混、专有名词、多音字、数字金额、情绪风格、口语化表达等场景。
制定和维护 TTS 评测标准,明确错读、漏读、多读、卡顿、爆音、破音、停顿异常、语调不自然、情绪不匹配等问题的判定规则。
负责 TTS 主观评测,包括 MOS 打分、AB 对比、问题标注、badcase 归因和结果复核。
对模型生成音频进行精听,定位问题来源,区分文本处理、发音、韵律、音质、情绪控制、音色稳定性、生成稳定性等问题类型。
整理评测结果和典型 badcase,输出结构化分析结论,为模型优化、数据补齐和版本迭代提供依据。
配合算法、产品和数据团队完成模型横评、版本回归评测、专项能力评测和上线前质量验收。
参与评测流程优化,提升评测一致性、人效和结果可信度,减少主观判断偏差。
岗位要求:
统招本科及以上学历,语言学、播音主持、中文、英语、音乐、音频制作、计算机、人工智能等相关专业优先。
具备较强的语音听辨能力,对发音、音质、节奏、停顿、重音、语调、情绪变化敏感。
普通话标准,能准确判断中文发音、多音字、轻重音、儿化音、语气词、断句和自然表达问题。
英语能力良好,能判断常见英文单词、品牌名、人名、地名、缩写在 TTS 中的发音是否准确;英语六级或同等能力优先。
有 TTS、ASR、语音合成、语音评测、音频标注、语音数据质检经验者优先。
具备较强的标准意识,能按照统一规则稳定评测,不凭主观感觉随意判断。
具备较好的问题归纳和分析能力,能从大量音频样本中总结高频问题,并形成清晰的 badcase 结论。
工作细致、耐心、责任心强,能接受长时间精听、复核和重复性评测工作。
具备良好的沟通协作能力,能与算法、产品、数据标注团队准确同步问题现象和评测结论。
有音乐、配音、有声书、播客、广播、播音主持、声音训练相关经验者优先。