ai绘画太傻?先别卸载,这5处我改完出图立马不一样
先泼盆冷水:出图傻,八成不是模型傻,是上面五个环节里有人偷了懒。我拿同事那张被吐槽了一晚上的翻车图现场改,从提示词到分辨率一路排下来,二十分钟后出图废片率从七成掉到两成。你先照着这五处排查,再考虑要不要骂AI。
上周五下午,隔壁工位的小赵把屏幕一转,冲我喊:「这ai绘画也太傻了吧,画个人六根手指,背景全是乱码!」我凑过去看了眼他的操作界面,提示词栏里孤零零躺着五个字:「一个女孩,好看」。得,案子破了。ai绘画太傻这事我听过不下二十回,拆开一看,十次里有九次卡在同样几个地方。那天下午我拿他的图当教材,把五个病灶挨个改了一遍,过程都在下面。
第一处和第二处:提示词太瘦,负面词还空着
提示词低于二十个字,模型就只能自由发挥,废片率飙升;负面提示词空着不填,等于放任六指和乱码自由生长。这两处是新手翻车重灾区,改起来也最快。
小赵那句「一个女孩,好看」,信息量约等于零。模型不知道女孩在干嘛、穿什么、什么画风,只能从训练数据里抓一把最平均的东西糊给你,出来的自然是那种一眼假的网红脸。我让他改成「一个短发女孩坐在咖啡馆窗边看书,暖光,胶片质感,浅景深」,字数翻了四倍,第一轮出图就直接能看了。
负面提示词更是重灾区。我看过太多人这一栏常年空白。补上「多余的手指、畸形、模糊、低画质」这几条,六指问题当场少了一大半。模型不会读心术,你没告诉它别画什么,它就敢什么都画给你。
为了服人,我后来专门做了轮小测试:同一句短提示词连跑十次,废了八张;同一模型换成那段加长版提示词,十次只废两次。变量只动了字数,差距却摆在那,这不比讲道理好使?
第三处:CFG和步数,两个最容易被瞎拉的旋钮
CFG拉太高画面会僵而且容易崩坏,采样步数低于20细节糊成一团,新手建议CFG设在6到8、步数25到30。这两个参数不是越高越好,是越合适越好。
小赵的CFG开到了14,理由是「越高模型越听话」。方向反了。CFG管的是模型对你的提示词有多执着,拉太高它就开始用力过猛,颜色糊成一坨,人脸跟塑料似的。我把它拉回7,步数从默认20提到28,单张出图多了三秒,但细节肉眼可见地回来了。他盯着屏幕看了半天,说了句「原来傻的是我」。嗯,这话我爱听。
顺带说一句采样器,别被名字吓住。日常出图用DPM++ 2M Karras这一类就够稳,速度和质量的平衡点找得比较好。我试过把一排采样器全跑一遍,同参数下单张耗时从11秒到17秒不等,画面差距其实不大,挑一个顺手的用熟,比天天换采样器实在。
第四处和第五处:模型跑偏了,分辨率又太抠
用二次元模型画写实人像,怎么调都别扭;出图分辨率低于768再想放大,细节根本救不回来。模型和用途要配对,分辨率要给够,这是很多翻车图的最后一块拼图。
小赵当时加载的是个主打动漫风的模型,却想要写实照片效果,这不就是让川菜师傅做粤菜嘛,手艺再好也不对味。换回写实系底模之后,同样提示词,出图质感直接换了个次元。
分辨率那处更隐蔽。他习惯先出一张512的小图,看着不行再硬放大三倍,结果糊得像打了马赛克。正确顺序是先出768以上、再配放大流程做二次处理,我后来给他指了篇现成的AI放大修清晰度的教程,他照着走了一遍就没再抱怨过糊图。五处全改完,他那天下午出的图,废片率我帮他数了,十张里只废两张。
这一套排查下来也就二十来分钟,却有人宁愿骂一个月的AI也不肯低头看一眼参数。工具没有脾气,只有习惯,习惯这东西,改起来比想象中快得多。
下班前小赵把他那张「傻图」设成了工位屏保——改好之后的版本。同一台电脑、同一个模型,前后隔了俩小时,像两个人画的。所以再听到有人喊ai绘画太傻,我一般不辩解,直接让他们把操作界面打开给我看。毛病都摆在明面上,就看你想不想改。
常见问题
提示词写多长才算够?
我的经验是30到60个字最顺手,把主体、动作、场景、风格、画质五样交代齐就行。再长收益会递减,堆到两三百字模型反而抓不住重点,不如把字花在关键细节上。
在线工具没有负面提示词的输入框怎么办?
不少在线工具把负面词内置在「画质增强」或「排除项」这类选项里了,找找设置面板。实在没有的,就在正面提示词里写清楚画面里不该出现什么,部分模型也认这种写法,效果略打折扣但聊胜于无。
同样的提示词,为什么我出的图就是比别人差?
先对比三样东西:模型版本、采样器、分辨率。我在群里帮人排查过十几次,八成的「玄学差距」最后都落在模型不一致上。把这三样对齐,再来谈提示词的差距才有意义。
参数要不要每次都重新调?
不用。定好一组顺手的默认值,比如CFG7、步数28,日常就锁死它。只在换模型或者换题材时动一动,参数永远微调会把你变成调参机器,忘了出图本来是干嘛的。