AI配音用语有哪些?配音圈的行话黑话词典
简单说:配音的行话分三层——基础层(声线、音高、语速、情感的参数族)、工程层(干声、分轨、响度、LUFS的制作族)、进阶层(SSML、克隆、SVS的技术族),最大的坑是半懂不懂——参数面板上每个词都"大概知道"但说不清,调音就变成瞎蒙,这份词典把"大概"变成"精确"。
"把音高降两档,干声给我,响度对齐负十六"——配音协作里的每句话都是术语的堆叠。这篇做一份实用词典:从参数到工程到技术,按使用频率排序讲透。
基础层:参数族
参数族的核心术语——声线(voice:声音的"音色身份",同一引擎的多款声音)、音高(pitch:声音的高低,常以±档位调节)、语速(rate/speed:常以小数倍率表达,1.0为标准)、情感(style/emotion:引擎的情绪预设,如cheerful、serious)、停顿(break:句间的静默,文本层用标点控制),五件是TTS参数面板的常客。
音高的档位感:+2 以上是"亮区"(年轻化)、0 是"标准区"、-2 以下是"沉区"(厚重化)——档位的语言("降两档"=更沉)是配音沟通的速记。语速的倍率感:0.85 以下"催眠区"、0.9-0.95"从容区"、1.0"标准"、1.1 以上"快区"、1.25"清晰度悬崖"——倍率的具体感受比数字重要。情感的档位命名对照:cheerful(欢快)、serious(严肃)、affectionate(深情)、sad(悲伤)、angry(愤怒)、whisper/soft(轻柔)——引擎间的命名略有差异但语义相通。
参考各参数的应用细节:调配音那篇的六步流程是参数族的实战手册。
工程层:制作族
制作族的核心术语——干声(dry:无效果的原始人声)、湿声(wet:加过效果的处理声)、分轨(分声道的独立音轨:人声轨、音乐轨、音效轨)、混音(mixing:多轨的平衡合成)、母带(mastering:成品的最终处理)、响度(loudness:感知音量)、LUFS(响度单位:平台的标准计量),七件贯穿配音的后期协作。
干湿声的协作含义:"发干声给我"=要未处理的原始(对方要做后期)——理解干湿是协作的基础(给错版本是新手事故)。LUFS的 平台标准:短视频平台约 -16LUFS(主流)、播客 -16 到 -19、音乐 -14——"对齐负十六"的行话就是响度规格的速记。分轨的交付逻辑:专业交付的分轨包(人声、音乐、音效的独立文件)给下游最大调整空间——商单的规格谈判常含"要不要分轨"(分轨加价是行规)。
进阶层:技术族
技术族的核心术语——TTS(Text To Speech:文本转语音)、SSML(语音合成标记语言:精确控制发音的代码标注)、克隆(voice cloning:音色复刻训练)、零样本(zero-shot:极少量样本即用)、SVC/SVS(歌声转换/合成)、采样率(音频的精度:48kHz为视频标准)、码率(压缩的质量:320kbps为高品质MP3),七件是技术对话的门槛词。
SSML的实用入门:它是控制发音的标签语言——<break time="500ms"/>(半秒停顿)、<prosody pitch="-2st">(降两半音)——支持SSML的引擎能做到文本标点做不到的精确控制,重音和多音字的终极方案,参考台词那篇的标记应用。采样率和码率的速记:视频配音 48kHz、音乐发行 44.1 或 48kHz;MP3 的 320kbps 近无损、128kbps 是"能听"线——交付规格的行话("给我48k的高码率")就这么读。零样本和微调(克隆的两档):零样本(几十秒样本即用、像度中)、微调(分钟级训练、像度高)——克隆需求的行话对齐("要走微调档")参考配音定制那篇。
行业层:生意族
生意族的核心术语——试音(接单前的样音)、成片时长(计价的净时长)、买断(版权的一次性买断)、授权范围(使用的边界约定:商用/非商用/渠道)、返修(修改的行话:"含两轮返修")、声线卡(参数的存档文档),六件是配音生意的协作词。
试音的行规:免费试音一分钟内(自我保护的上限)、试音段选难点(展示力的选择)——试音的行话("发个试音")背后是行规的默契。计价的三态:按条(短视频逻辑)、按时长(长内容逻辑,参考小时配音那篇)、按项目(打包的定制逻辑)——三种计价的行话对应三种生意形态。声线卡的行话位:"把卡发我"=声线参数档案的共享(协作的效率工具),卡的文化(参数的文档化)是配音圈 AI 时代的新行规。
据Statista的创作者经济数据,配音相关的协作需求(外包、合伙、平台接单)在持续增长——行话的掌握是协作圈的入场券。
我的实录:词典的由来
这份词典的雏形是我带新人的内训文档——新人第一次听"干声给我、对齐负十六、降两档"的三连,一脸茫然(每个字都懂连起来不懂)——术语的断层是协作的最大摩擦,文档化的词典让新人的一周适应期压到两天。词典的使用法建议:不用背(工具书不是课本)——收藏本文,遇到听不懂的行话回来查,三个月的自然使用后这些词就成自己的了——术语的习得靠使用不靠背诵。
行话的边界意识:行话是效率工具不是装X资本——对客户说"LUFS对齐"不如说"音量调到平台标准"(沟通的翻译意识)——行话对内(同行协作的速记)、人话对外(客户沟通的清楚),两种语言的切换能力比词汇量本身值钱。
延伸阅读可以看维基百科音频工程词条的相关内容,交叉验证后形成自己的判断。
常见问题
术语要全学会才能开始配音吗?
不用——基础层(参数族)够起步,工程层和技术层在实践中遇到再学——配音的入门门槛是"会用参数",不是"懂所有术语",先跑起来再补课。
哪里查引擎的SSML支持情况?
各引擎的官方文档(Azure、火山的SSML文档都很全)——支持的标签列表和示例代码齐全,本文给的入门两标签(break、prosody)是通用度最高的。
客户说的"质感"是什么术语?
行话的模糊词——"质感"通常指音色的品质感(厚度、干净度、岁月感的综合)——追问一句"具体是哪里不舒服"(太薄?太糊?太年轻?)把模糊词翻译成参数词,是配音师的沟通功力。
有更全的术语资源吗?
音频工程的大全看Wikipedia的audio engineering词条(英文的体系化)、中文的实用版就是本文+本站的系列文章(每篇的术语都在具体场景里讲)——场景化学术语比词典化学得牢。
行话是协作的速记。参数的实战看调配音那篇,后期术语看录音处理那篇,SSML应用看台词那篇,克隆术语看配音定制那篇。
觉得有用的话把这份词典分享给配音圈的朋友吧,把"大概知道"变成"精确能说",调音就不瞎蒙了。