ai绘画小明四不像?把国民角色拆成提示词的笨办法

ai绘画小明四不像?把国民角色拆成提示词的笨办法
ai绘画小明简笔卡通角色的圆脸豆豆眼造型示例

先说结论,模型画不出小明,不是它画功不行,是它不认识"小明"这两个字。你嘴里的国民角色,在它那儿就是个没见过的英文名。想让它画对,就得像个画室老师带新生那样,把长相一项一项念给它听。

ai绘画小明这个需求看起来简单,真上手才知道坑在哪。我头一回做的时候直接写了"xiao ming, classic cartoon character",出来一个真人小男孩背着书包,写实得能去拍教育机构广告。后来我不死心,把中文塞进去试,更乱,模型开始自由发挥,给我画了个戴眼镜的漫画少年。那一刻我就认了:这个名字在训练数据里没有稳定的锚点,想画对只能靠拆特征。

为什么模型总是听不懂"小明"?

因为"小明"在训练集里没有固定的视觉形象,它是个代号不是一张脸。模型靠词找图,词后面没有挂稳定的图像簇,输出就会随机落到它认识的相近概念上,比如真人儿童、漫画学生。解决思路只有一个,自己当锚点,把特征补齐。

这事跟画同人一个道理,只是小明这个形象更极端——它本来就是课本插图和黑板上那种极简画法,大圆脸、两点眼、一道弧线嘴,身上白衬衫配蓝裤子,顶多加条红领巾。这些东西你要是不写,模型就按它对"卡通男孩"的平均理解去画,平均理解可不是小明。我后来固定了种子做对照:同一组词,只把"小明"换成特征描述,出图四十张里能用的从零涨到九张,差别就这么大。

还有个容易忽略的点:别把"小明"和"火柴人"混为一谈。火柴人是线条加圆头,小明是有服装色块的低幼简笔风。你写 stick figure 出来的东西就是数学老师画几何图用的那种,跟表情包里的小明差着十万八千里。

特征到底要拆到多细才够用?

拆到"闭着眼能照着画出来"的程度:脸型、五官、发型、服装、配色,五项缺一不可。每项用短词硬写,不要写成散文句。拆得越死板,模型发挥空间越小,越像你想的那个小明。

给我跑通的一组参考:simple flat cartoon boy, perfectly round face, two dot eyes, tiny curved smile, short black hair with straight bangs, white shirt, blue trousers, red neckerchief, thick outlines, kindergarten textbook illustration style。这一串看着啰嗦,可是每项都在堵一个歧义口子。比如不写 straight bangs,模型给你来个中分刘海,气质立刻不对;不写 thick outlines,线条会飘成日漫风。我试过把这串缩到一半,出图就开始漂,缩到三分之一基本没法看。

配色也别省。小明的辨识度一半来自白衬衫蓝裤子这个固定组合,就像马里奥的红帽子,颜色就是角色证。有一次我图省事写了 casual clothes,出来个穿卫衣的男孩,朋友看了说挺可爱,可是没人觉得那是小明。表情包要的就是一眼认出来,颜色不能让。

画对了之后,怎么改成能发的表情包?

表情包化只动两处:表情强度和构图留白,角色特征一个字都不能改。把嘴角、眉毛、眼睛这些词单独拎出来加重写,再配上对话气泡的空位,九宫格一下午就能填满。

我的流程是先出一张满意的基准图,固定种子,然后只替换表情词:躺在地上的"瘫"、嘴角上扬加挑眉的"坏笑"、眼睛变蚊香圈的"晕"。每换一组词出四张,挑一张,一个晚上做了十六个表情,能用的十一张。做的时候有个发现:豆豆眼的角色表情全靠嘴和眉毛撑,眼睛本来就俩点,你想让它"瞪大"是瞪不起来的,得靠把眼睛的点换成圆圈来放大情绪,这是做简笔角色跟做写实角色完全不同的手感。

构图上记得留白,表情包右侧或下方得空出来放字。我吃过亏,第一批图人物顶天立地,加字的时候只能压在脸上,发出去被吐槽字挡脸。后来每张都主动写 negative space at bottom,才算解决了。

回头看那个背书包的写实小男孩,其实不冤,我什么都没告诉模型,它只能瞎猜。ai绘画小明这件事,考的不是模型的画功,是你对自己要的那个形象了解多深。圆脸多大、发型什么样、穿什么颜色,你答得越快,图出得越稳。手头正想做小明表情包的话,先把那五项特征列出来,列完再开跑。

常见问题

用垫图加一张小明的参考图行不行?

行,而且快。垫图能把特征锁个七八成,剩下靠文字补。要注意参考图本身别带水印和复杂背景,不然这些杂物会被一起学进去。

出来的图总有点像别的卡通男孩怎么办?

正常的,特征池就那么大,重叠难免。差异点放在细节上:发际线的弧度、领巾的系法、腮红有无,挑一两个别人没用过的记号安上去,辨识度就有了。

需要给小明申请什么版权授权吗?

课本简笔小明属于大众创作形象,日常做表情包自用和发群里没什么问题。要是想商用,建议自己重新设计五官和配色,做出明显区别,稳当。

手机上能做这套流程吗?

能,现在不少App的特征词输入没有门槛,就是排队慢些。手机适合出想法,定稿还是电脑上跑更省时间。

延伸阅读