高木ai绘画总画不像?双马尾和虎牙的特征词才是关键
别绕了:AI画二次元角色像不像,靠的是两三个标志性特征词,不是堆一堆画风形容词。我拿30张图做对照实验,特征词拆对的角色一眼认得出,拆错的十张有八张面目模糊。先把角色拆三层,再去碰模型和参数。
起因是朋友家上初中的侄女,让我帮忙画几张高木ai绘画风格的同人图。我心想二次元角色我画过不少,应该不难,结果第一轮10张图出来,她看了一眼就摇头:「这谁啊,画的是个普通女生吧。」被一个初中生嫌弃,这事我得扳回来。后来我专门跑了一轮对照实验,30张图、改了4版特征词,总算摸到了门道——问题不出在画风词,出在我根本没认真拆过这个角色到底「标志」在哪。
这篇就把我的拆法和实测数据摆出来。顺带说一句,画学生角色的同人图,内容得干净,不拿去商用、不冒充官方,这条底线后面还会提。
角色要拆三层,特征词只留标志性的
把角色拆成发型、表情、服装三层,每层只留一两个最有辨识度的词。特征词堆得越多,AI越容易把它们搅成一锅粥。
我的拆法是这样的。发型层:黑色长直发、中分刘海;表情层:坏笑、单边虎牙、脸颊红晕——这三样是她最抓人的记忆点,比五官本身还重要;服装层:水手服校服。三层各留两三个词,一共不到十个词,其余全删。第一版我失败了,就是因为写了一大段「长发及腰、大眼睛、精致五官、大师画风、超高细节」,AI给的确实是个漂亮路人。
30张的对照结果挺有意思:只带「坏笑加单边虎牙」这两个表情词的10张里,8张一眼就是那个味道;去掉虎牙只写微笑的10张里,只有2张勉强能认。红晕这个小词我也差点漏掉,加上之后整个画面的「捉弄感」才立起来。你看,二次元角色的辨识度根本不在「画得多精致」,在特征词选得准不准。
还有一个反直觉的发现:画风词放少了反而好。我试过在提示词里加四种画风描述,出来的图既不像A也不像B,特征还互相打架。锁定一个画风来源就够了,比如统一走日式TV动画风,别贪。
模型和参数,我是这么调的
二次元角色优先选动漫特化模型,我实测用niji模式出图最稳,配合垫图能压住特征漂移。参数上步数和CFG别拉满,够用就好。
工具上我跑了两条路。一条是在线端用niji这类动漫向模型,出图质量稳定,角色那张脸几乎不用修;另一条是本地SD挂二次元底模,自由度高,但得自己挑模型,我那个8G显存的卡跑30步一张大约35秒,一晚上出60张挑3张,是常态。
参数我踩过的坑说三个。第一个是CFG,我一开始拉到12以上想「更听话」,结果颜色过饱和,脸都画油了,后来稳定在7左右。第二个是采样步数,25到30步足够,再往上纯粹烧时间,画面差别肉眼难辨。第三个最关键:想让10张图是同一个人,光靠提示词不行,得垫一张参考图,或者干脆训一个LoRA。垫图版的10张里我挑出了6张连贯的,不垫图的10张里只有2张能用。想自己训模型的,可以看我之前整理的LoRA训练入门,几百张同角色图就能起步。
跑批量的时候记得留好参数记录。我有天手滑改了随机种子没记,第二天想复刻前一晚最好的一张,跑了20张都没对上,气得我半宿没睡好。现在每张满意的图,种子和参数我都截图存档。
同人图好玩,但边界要自己守
画角色同人自娱没问题,商用、冒充官方、生成不当内容这三条线不能碰。发布时标注AI生成,是对自己最省事的保护。
几个实际的做法。发布图的时候我会在文案里注明是AI生成的同人作品,别拿AI图冒充手绘去接稿,那个雷迟早炸。不拿角色图做周边去卖——同人的商用边界本来就模糊,AI生成的再加一层风险,双倍雷区。还有前面提过的,学生角色的图,内容必须是正常的校园日常,这个不用多解释。
想看别的角色是怎么靠特征词立住的,可以参考我之前拆过的火影风格角色出图思路,套路是通的:先拆特征,再谈画风。
实验跑完,我把最好的一张发给了那个侄女。她回了一个字:「哥!」后面跟着仨感叹号。第二天她拿去当头像,班里同学来问是哪来的图。你看,二次元AI绘画这件事,难点从来不是把图画得多华丽,是替那个角色找到她最标志性的那两三个词。找对了,AI一秒就懂;找不对,你写一百个形容词也是白搭。
常见问题
没有参考图,纯文字能画出指定角色吗?
知名角色可以,模型训练时见过大量相关图,特征词到位就有七成像。冷门角色或原创角色纯文字很难稳定,建议垫图或训LoRA。
为什么每次生成的脸都不一样?
提示词管不住随机性。固定种子加垫图是立竿见影的两招,要求再高就训LoRA,我把参数截图存档的习惯就是被这个逼出来的。
画好的同人图能发到社交平台吗?
注明AI生成、不商用、标注原作出处,正常分享基本没事。别删水印冒充官图,也别拿去做头像倒卖。
手机上能画二次元角色吗?
能,各类在线出图App和网页端都能跑动漫模型。手机适合出想法和草稿,批量出图和精修还是电脑舒服,我60张挑3张的活全在电脑上干。