AI绘画猫和老鼠怎么画?经典动画角色出图

AI绘画猫和老鼠怎么画?经典动画角色出图
猫和老鼠的ai绘画出图效果展示,Tom与Jerry经典追逐场景

简单说:猫和老鼠的ai绘画想出像样图,核心是找对卡通LoRA加白底提示词,CFG压到4-5,步数20-25就够,别开高权重否则脸崩。

说实话,猫和老鼠的ai绘画这事儿比我想的难搞。一上来我以为随便打几个词就能出Tom追Jerry的经典画面,结果第一张图两只猫——没错,两只猫,Jerry直接没了。这动画角色看着简单,线条就那么几笔,可AI偏偏画不出那股子"歪歪扭扭手绘味"。

我个人觉得,问题出在大多数人拿写实大模型直接硬画卡通。写实模型脑子里装的是人脸光影,你让它画扁脸圆眼的老鼠,它就懵了。得换思路。

这篇我把踩过的坑和最后能稳定出图的法子都写下来。不是教程搬运,是我自己反复试出来的。

先挑模型:别用写实底模硬画卡通

画猫和老鼠优先用 AnythingV5、卡通专用底模或 SDXL 的卡通变体,写实大模型出的图一股"人偶味",不像动画。我自己试下来,AnythingV5 + 一个手绘卡通LoRA,出片率比 SD1.5 写实底模高出一大截。

为什么要换底模?写实模型见过的训练图全是真人,肌肉、毛孔、光照那套逻辑刻进骨头里了。你输入"Tom the cat",它给你画只毛茸茸真猫。换卡通底模就不一样,它脑子里是扁平色块、粗描边那套。

根据 Civitai 模型库的标签统计,动漫/卡通类底模的下载量常年排前三,说明大家都在踩同一道坎。这也是为什么我反复劝新手别拿 SDXL 默认那套写实 preset 画动画角色。

没头绪的话先看这篇什么是AI绘画补补底子,了解底模、LoRA、采样器的关系再动手。

提示词模板:白底、粗线、扁平上色

核心三件套是"white background, thick black outline, flat coloring, Hanna-Barbera style, 2D cartoon",加上具体角色描述,权重别超过1.2。这三件套一出,画面质感立刻往老动画靠。

我贴个实测能用的模板,你直接改:

Tom the cat from Tom and Jerry, grey blue cat, angry expression, Hanna-Barbera cartoon style, thick black outline, flat cel shading, white background, dynamic pose, chasing, 2D animation, vintage cartoon --no realistic, 3d, photorealistic

Jerry同理,换成"brown mouse, big ears"。两个角色同框时,建议用区域提示词(Regional Prompter)把猫和老鼠分块,不然脸会串。我第一次同框出图,Tom长出了Jerry的圆耳朵,吓我一跳。

权重这块要啰嗦几句。新手爱把角色LoRA权重开到1.5求"更像",结果比例崩——身子小、脑袋大、手关节反着折。老实讲,0.7-0.9才是甜区。下面会单独讲翻车。

想要更系统的提示词写法,可以翻翻怎样创作AI绘画那篇,里头从灵感到成片讲得细。

实测参数:CFG 4.5、步数22、DPM++ 2M Karras

我稳定出图的一组参数是 CFG 4.5、采样步数22、DPM++ 2M Karras、宽高768x768,单张约15秒,崩图率从六成降到一成。这组是我在6600显卡上跑了大概80张之后定的。

讲下为什么这么设。卡通画面信息量低,不需要高步数堆细节,22步画面就干净了,再往上反而出杂边。CFG高了会过饱和——Tom的灰蓝毛被拉成荧光蓝,看着像辐射猫。4.5是个稳的值。

DPM++ 2M Karras 这采样器画线条顺滑,适合卡通。Euler a 也行但偏柔。我对比过同提示词下两种采样器,Karras的描边更利落,Euler a 的色块过渡更糊。

分辨率别贪大。1024直接上,卡通LoRA扛不住,边缘会出锯齿和伪影。768够用,要清晰就后期高清放大走。

出图慢的话参考怎么快速AI绘画的提速法,里面有显存和步数的取舍技巧。

翻车现场:权重1.5把Tom画成了外星人

角色LoRA权重超过1.2,猫和老鼠的脸会畸变,常见症状是眼睛挤一起、嘴歪到腮帮、四肢关节反折,概率约三成。这是我连画20张统计出来的。

那次我想让Tom更像动画原型,手贱把权重从0.8调到1.5。出图那一刻我愣了——Tom的嘴咧到耳朵根,眼珠挤成一颗,前爪反关节朝后折,活像外星人Cosplay。不是恐怖谷,是直接恐怖。

调回0.8立刻正常。我又试了1.0、1.2,1.0还行,1.2开始嘴角抽搐。结论:这LoRA的安全区是0.6-1.1,超过就赌。

另一个坑是负面词漏写"realistic"。不写的话,每三四张会蹦出一张毛绒质感真猫,混在卡通里特别违和。补上 --no realistic, photorealistic, 3d 之后稳多了。

顺带一提,判断一张图是不是AI画的也有门道,看怎么判断是不是AI绘画能学到识别痕迹,反向也能帮你查自己图的破绽。

动态场景:追逐画面怎么不糊

追逐同框要用Regional Prompter分块,加motion blur和speed lines提示词,背景留白避免抢戏,出图后可手动加放射线增强动感。追逐是猫和老鼠的魂,但也是最容易糊的。

两人同框追跑,AI分不清谁是谁,容易脸串色串。分块提示词把Tom放左、Jerry放右,各画各的,干净。动态模糊别加太重,blur strength 0.3左右,太重整个画面糊成一团。

速度线我习惯后期PS加,AI画的速度线经常方向乱。手动加几条放射线,瞬间有那味了。

还有个偷懒法:分两步。先单独出Tom奔跑图、再出Jerry奔跑图,抠图合到一起。可控性强,缺点是没有互动张力。看你要效率还是要感觉。

风格变体:复古赛璐珞 vs 现代重制

想要1940s原版质感加"vintage cel animation, film grain, slight desaturation";要2020s重制质感加"clean vector, modern cartoon reboot, vibrant color",二者LoRA可共用。风格切换主要靠提示词,不换模型。

我个人偏爱复古赛璐珞。那种带颗粒、偏黄、线条抖的质感,才是猫和老鼠的魂。现代重制版太干净,反倒像别的片。

颗粒感别靠LoRA,提示词"film grain, slight vignette"就够,强度自然。太重像劣质扫描件。

维基百科Tom and Jerry词条,这动画从1940年首播,原始短片用的是当时米高梅的赛璐珞动画工艺——这种工艺本身就是扁平上色加描边,正好对上我们提示词那套。

常见问题

猫和老鼠AI绘画必须用LoRA吗?

不是必须,但强烈建议用。纯靠提示词也能出个大概,但Tom的灰蓝毛色、Jerry的圆耳这些细节靠LoRA才稳。不用LoRA,出图十张里能用的就两三张;用了能到七八张。差别很大。

哪个模型画猫和老鼠最像?

没有"最像"的单一答案,但 AnythingV5 系列加一个手绘卡通LoRA 是我测下来最稳的组合。SDXL 卡通变体也行,出图更精细但要显存。新手从 AnythingV5 起步门槛低。

为什么我画的Tom总是变成真猫?

多半是底模太写实加负面词没写"realistic"。换卡通底模,负面词补上 --no realistic, photorealistic, photograph, 3d render,基本能解决。还变真猫就检查LoRA是不是没触发。

能商用猫和老鼠的AI出图吗?

不能。Tom和Jerry是华纳的版权角色,AI生成的形象即便风格再像,商用仍属侵权风险。自己玩、做头像、练手没问题,一旦涉及卖钱、印商品、做广告就得避开。想商用就画原创猫鼠角色。

觉得有用的话分享给朋友吧。