佟湘玉配音AI怎么选?方言角色的voice选择法
简单说:方言角色的voice选择两法——方言voice的查找(有原生方言voice的直接用)、没有时的近似选法(普通voice+方言化处理的凑法),选完的角色匹配验证,最大的坑是随便选个voice硬念方言词(既不方言也不角色)。
上一篇讲了佟湘玉的配音配方(参考佟湘玉那篇的复合配方),这篇聚焦配方里的第一步——方言角色的voice怎么选(方言voice的选择法)。
方法一:方言voice的查找
方言角色选voice的第一法是查找方言voice——主流TTS的方言覆盖查询(粤语川话等常见方言的覆盖)、查到的直接用(原生方言voice的优势)、查不到的转近似法,查找是第一步。
查找法:
覆盖查询:方言的覆盖查询——主流TTS的方言支持(Azure等的方言voice:粤语、四川话、东北话等常见方言的覆盖——工具的方言清单查询),覆盖的盘点。据微软Azure语音服务的语种列表,中文方言的voice有部分覆盖。
直接用的优势:直接用的优势——原生方言voice的自带方言腔(方言的调值和韵味原生——省去近似的功夫),原生的优势。
查不到转法:查不到的转法——没有该方言voice时的近似法(下一节的凑法),转法的路径。
方法二:近似选声法
没有方言voice时的近似选声——基础voice的筛选(按角色的基础特征筛)、方言化的处理(调值和语调的手动近似)、近音字的方言读法(方言词的读音凑),近似法的三步凑。
近似三步:
基础筛选:基础的筛选——按角色基础特征筛voice(佟湘玉的例子:中年女声+偏亮利落+精明感的基础筛选——参考佟湘玉那篇的声线配方),基础的voice底。
方言化处理:方言化的处理——调值语调的手动近似(陕西话的调值特征近似——参考口音那篇的方言调法),方言的近似处理。
近音字凑:近音字的凑法——方言词的读音凑(方言词用近音字标注让AI念出近似方言音——参考名字那篇的同音字思路的方言应用),读音的凑法。参考潮汕那篇的近似方案——方言近似法的同类应用。
角色匹配的验证
选完voice的角色匹配验证——角色的贴合试听(voice像不像这个角色)、方言的味儿验证(方言感的地道度)、违和感的检测(voice和角色的违和排查),验证是选择的最后一关。
验证法:
贴合试听:贴合的试听——角色台词的实测(用角色的代表性台词试听——voice的贴合判断),贴合的试听。
方言验证:方言的验证——方言感的地道度(找方言区的人听——方言味的验证,参考潮汕那篇的本地人验证),地道度的把关。
违和检测:违和的检测——静音看角色再开声的违和检测(外表和声音的违和排查——参考数字人那篇的违和自检思路),违和的排查。
方言voice的选择决策树
方言voice的选择决策树——第一步查原生(有直接用)、第二步近似凑(没有就近似)、第三步验证定(验证通过定选),决策树的路径化选择。
决策树:
第一步查原生:查原生voice——方言覆盖的查询(该方言有没有原生voice——有的最优路径),原生的优先。
第二步近似凑:近似凑法——没有原生时的近似(基础筛选+方言化+近音字的三步凑——参考闽南那篇的借力方案——借相近方言的变通),近似的务实。
第三步验证定:验证定选——贴合+地道+违和的三验证(验证通过定选、不通过回调),验证的定选。参考选声那篇的四步决策——通用选声+方言的特殊层的组合。
预算的考量:预算的考量——原生voice可能要付费(专业工具的方言voice)、近似法的低成本(普通voice的免费凑),预算的权衡。
我的选择实战:佟湘玉的选声
我的佟湘玉选声实战——原生查找(陕西话voice的查询结果)、近似选声(普通voice的方言化)、验证定选(本地朋友的验证),一个方言角色的完整选声过程。
我的实战:
原生查找:原生的查找——陕西话voice的查询(主流工具的方言清单查——陕西话的原生voice没找到),查找的结果(转近似法)。
近似选声:近似的选声——基础筛选(中年女声+偏亮利落的候选筛出3个)+方言化(陕西调值的特征近似——参考佟湘玉那篇的调法)+近音字("额滴神啊"的方言词近音标注),近似的完成。
验证定选:验证的定选——角色贴合试听(3个候选的角色台词实测——最像的1个)、陕西朋友的方言验证("有七成像,够用"的地道度反馈——参考潮汕那篇的七成像标准)、违和检测(过了),定选完成。
实战的总结:方言角色的选声走"查原生→近似凑→验证定"的路径(佟湘玉没有原生走了近似——七成像的实用级),选择加处理的组合(voice的选择+方言化的处理才能出方言角色)。参考吴语那篇——不同方言的同类应用。
常见问题
佟湘玉配音AI怎么选?
选择决策树。第一步查原生(陕西话voice的方言覆盖查询——有直接用的原生优势)。第二步近似凑(没有原生时:基础voice筛选按角色特征+方言化调值处理+方言词近音字凑读——三步近似)。第三步验证定(贴合试听+方言区人验证地道度+违和检测)。佟湘玉实例:无原生voice走了近似(中年女声基础+陕西调近似+额滴神啊近音)——七成像的实用级。
为什么有的方言没有voice?
市场的覆盖度——TTS方言voice的开发成本(每种方言的语料和模型投入)vs 市场需求(大方言粤语川话的需求大有小——小方言的商业回报低没动力做),所以覆盖不均(大方言有小方言无)。趋势:方言保护的需求在推动覆盖扩展(越来越多方言voice在出——持续关注更新)。
近似法能到几成像?
七成的实用级——近似的上限(普通voice+手动方言化的组合:调值近似到七成、方言词的近音到七成——综合七成的"有那味"),比纯普通话语调(零成像)强得多但到不了原生(十成像)。七成的够用标准:方言区的人"听着亲切"、非方言区的"有方言感"——双受众的够用。完美的十成等原生voice。
方言角色的voice选择和普通角色有什么不同?
多一层方言的考量——普通角色的选声(基础的角色匹配一层),方言角色(基础匹配+方言层的双重考量:既要像角色又要有方言味),选择的复杂度高一层。决策也是两法(原生优先+近似凑法的备份),参考本篇的决策树——方言角色的特殊化选择。
方言角色选声两法决策。佟湘玉配音配方看佟湘玉那篇,口音调法看口音那篇,潮汕近似方案看潮汕那篇,闽南借力看闽南那篇,选声四步看选声那篇,更多方言voice参考微软Azure语音服务。
觉得有用的话分享给做方言角色的朋友吧,选择的两法能选得更准。