AI绘画撒谎怎么办?你写东它画西,4招让AI乖乖听话

AI绘画撒谎怎么办?你写东它画西,4招让AI乖乖听话
AI绘画撒谎对比插画:左边提示词文字,右边AI画出的画面跑偏,教你让AI画图听话

别绕了:AI绘画撒谎不是模型成心骗你,是提示词太松,它按概率自由发挥去了。我两周抽了将近两百张图做对比,结论就一条——把话说到没有第二种理解,一次过的概率能从三成拉到八成。先做一件事,把下一条提示词里的空形容词全删掉。

上周我让AI画「一家人在院子里吃晚饭」,出了张图:孩子六根手指,狗有两条尾巴,桌上那盘菜悬在半空。朋友看了说,这就是AI绘画撒谎吧,你写东它画西。我当时也这么想。后来抽多了才发现,它压根不是在撒谎——它没听懂,它在补全。搞明白这一点之后,我的出图准确率从三成出头爬到八成左右,代价是大概两百张废图的学费。

它为什么会画错:模型在补全,不在服从

AI绘画撒谎的本质,是模型按概率补全画面,提示词越模糊,它自己脑补的空间越大。你写「漂亮女孩」,它得先猜什么叫漂亮,再猜你要哪种风格,猜错了真不能全怪它。

扩散模型认词的方式跟人不一样。「漂亮」这种词没有对应的画面,它只能从训练数据里捞一张统计意义上最接近的图。我做过一个小实验:同一句「一个漂亮女孩在喝咖啡」,连抽20张,出来13种画风——有油画的,有二次元的,还有一张像证件照。它不是不听话,是我那句话本身就给了它20种合理解释。

数量词也一样。「一家人」是几个人?它真的会犹豫。我写过一次「一家人合影」,第一次出来五个人,第二次是两个人带一只猫。数量不给死,它就掷骰子。

四招让它老实:把话写到没有第二种理解

治AI绘画撒谎靠四件事:内容具体化、数量写死、构图说清、锁种子微调,缺一样它就替你做主。下面是我踩完坑之后固定下来的写法。

第一招,把形容词换成看得见的描述。「精致的水晶鞋」改成「透明玻璃质感的高跟鞋,鞋面有折射光斑,侧面特写」。就这么一改,我这边一次过的概率肉眼可见地上去了。第二招,数量全部写明,三个人、四根柱子、桌上有两只杯子,别让模型猜。

第三招,构图说人话:谁在左谁在右,镜头是近景还是全景。第四招最省事,抽到一张八成满意的图就把种子锁住,只改一个词再抽,改哪动哪,不会牵一发而动全身。想系统补提示词底子的,可以看我之前写的那篇AI图修图语言,五个万能句式,跟这套思路是通的:AI图修图语言怎么用?5个万能提示词一键出片

容易翻车的写法改后的写法我的实测结果
精致的水晶鞋透明玻璃质感高跟鞋,鞋面有折射光斑,侧面特写基本一次过
一家人合影三口之家,父亲在左母亲在右,中间8岁女孩,全景人数不再乱跳
漂亮的房间北欧风卧室,原木家具,午后阳光从左侧窗户照进来风格终于稳了
帅气的机甲银灰色重型机甲,右肩挂盾牌,站姿,仰拍视角细节抽象得多,能打

这张表是我自己常翻的备忘。右边那列的写法每一条都改了至少五遍,不是抄来的。

抽到第几张该收手

同一句提示词抽8到12张还没一张能用的,别再抽了,回去改提示词,问题九成出在词上。继续抽只是重复掷骰子,费钱也费耐心。

我吃过这个亏。有一次为了一个「极简风带雕花的杯子」连抽37张,越抽越气。盯着提示词看了半天才发现——极简和巴洛克雕花根本打架,模型夹在中间左右为难,怎么抽都是四不像。改成「哑光白瓷杯,杯口一圈细金线」,第二张就过了。

手和五官这类小地方崩了,不值得整张重抽。用局部重绘圈住那只六根手指的手,重绘幅度压在0.3到0.4之间,我用SDXL跑30步采样,修一只手大概40秒,比整张重抽省多了。幅度别拉高,超过0.6连手腕附近的画风都会跟着变,修一次手毁半张图这种事我干过不止一回。

回到开头那张六根手指的全家福。修好它前后只花了3分钟:锁种子,圈手,重绘,微调。AI从来不是在撒谎,它只是把你的含糊当成了授权。话说死了,它比谁都听话——这话我用两百张图的账单验证过。不信的话,先拿你自己那条提示词开刀试试。

常见问题

AI绘画撒谎能彻底杜绝吗?

做不到百分之百。提示词写死加局部重绘之后,我这边可用率稳定在八成上下。纯文生图别指望每张都对,多人物和复杂构图尤其要留两三张的冗余,抽卡预算按这个备。

负面提示词要写多长才够?

十几个词就够,别堆。我常驻的就六七个:多余手指、畸形手、低分辨率、模糊、水印之类。写一两百个词反而互相稀释权重,画面会更乱,我专门对比过,长负面词列表那组明显更糊。

为什么加了高清和8K这类词,图反而更花了?

质量词彼此抢权重,对画面内容帮助很小。同句加与不加我测过,细节差别不大,真正决定画面的是主体、动作、光线这些内容词,质量词留一两个意思一下就行。

局部重绘和整张重抽,哪个更省时间?

看错在哪。手指、五官、文字这类小错用重绘,我这边40秒上下能修好;构图不对、人物站位错了就直接重抽,重绘救不了骨架层面的问题。