AI绘画艺术狂想实验:重建十个梦,一半画不出来

AI绘画艺术狂想实验:重建十个梦,一半画不出来
AI绘画艺术狂想的梦境重建插画:漂浮的鲸鱼与麦田

省流版:AI绘画做艺术狂想,梦境重建这条路四成能走通。奇观型的梦出片率最高,空间混乱型和纯情绪型的梦基本没戏。十个梦里我成了四个,翻盘靠的不是提示词,是几笔火柴人草稿。

这个实验的起因很俗:我床头放了个本子记梦,记了两年,攒下小一百条。AI绘画艺术狂想这个词前阵子看得多,总想试试拿梦当原料会怎样,于是从本子里挑了画面感最强的十个,逐个重建。

两周,十个梦,一百三十多张图。结果比我想的有意思——失败的梦里没有一个是因为「太离谱」,离谱恰恰是AI最擅长的。

十个梦的成绩单:四成接近,三成走样,三成失败

十梦重建战绩:四个接近梦里看到的,三个方向对但细节全错,三个完全画不出来。成绩最好的是超现实并置类,最差的是空间叠加和纯情绪类。

成功例子里最好的一张:鲸鱼游过麦田上空,麦浪压弯的弧度和鲸腹的弧度呼应。这个梦生成第三次就中了,AI对「把两个不相关的东西放到一个画面里」这类任务近乎本能,超现实并置正是它的母语。

走样的三个更值得说。有一个梦里图书馆的书架高到看不见顶,梯子悬在半空,人踩着梯子往上够一本发光的书。出来的图每次都把书架缩回正常高度——AI见过太多图书馆,它自作主张地「纠正」我的梦。改了十几版,书架最高的一次也只到天花板。梦里那种不合比例的压迫感,词给不出来。

彻底失败的三个,一个是「地板上的门」,门平躺在地板上,打开是往下走的楼梯。提示词怎么写,AI都给门装回墙上。一个是纯粹焦虑的梦,画面只有灰雾和心跳声——情绪型梦连可描述的视觉主体都没有,写出来就一句「灰色雾气」,出图当然平庸。

梦最难画的是空间逻辑,不是奇观

梦境的狂想内核是错乱的空间关系:上下颠倒、内外翻转、一个空间同时是另一个空间。现有生成模型对空间关系词的理解非常有限,「在地板上的门」这类描述十有八九被画成常规场景。

我试过把空间关系写得更啰嗦,「一扇木门平放嵌入地板,门板与地板齐平,门打开处露出向下的台阶」——啰嗦没用,它还是给我立着的门。模型不是听不懂每个字,是它的训练集里「门+楼梯」的组合几乎全是竖直关系的图,先验太强,几句话扳不过来。

空间叠加型更没辙。「教室的窗户外面是海底」这句,出图要么是普通教室,要么是海底教室的缝合怪——窗户倒是换成了玻璃幕墙,可那样就不是我的梦了。梦的可怕之处在于身在其中时完全合理,醒来用语言转述时信息量直接砍半,转述给AI,再砍一半。

有个细节我一直记得:那个失败的门之梦,我在词里写了「俯视视角」,AI就把整个房间画成俯视,门却还是立在墙上——视角词生效了,空间关系词没生效,两个词在它脑子里是两个世界。这种一半听一半不听的感觉,比完全听不懂还让人没脾气。

火柴人草稿垫图,居然是翻盘招?

有效的办法是自己画草图:用简笔火柴人加几何框,画出梦里各元素的位置关系,当垫图喂进去,垫图强度0.4左右。构图还原度立竿见影,AI负责把粗糙的骨架长出血肉。

这个招是气出来的。「地板上的门」改词十几版失败后,我抓过便签纸画了个俯视图:一个方框代表房间,房间中间画个带合页的长方形,加一个往下指的箭头。丑得没法看,垫图强度0.4喂进去——第四张,门在地板上了,楼梯朝下,连门板的木纹都像样。

从那以后十个梦我重跑了六个,全部先画草图。火柴人的「火柴」水平,反而成了优点:它只定位置和关系,不定风格和细节,AI有充分的发挥空间。这跟垫照片完全两码事,垫照片是抄,垫草图是命题作文。

成本也说下:一张草图两分钟,画完垫图出四张挑一张,单个梦从原来的半小时压缩到十分钟出头。十个梦全部走完,实际花了我六七个晚上——比预想累,但本子上一百个梦,够我玩两年。

实验做完,我对自己那本梦记的看法变了。以前觉得记梦是留着将来「万一能画出来」,现在明白大部分梦注定画不出来,能转译成画面的本来就是少数——而少数里成的那几个,比任何刻意的脑洞都怪。鲸鱼那张现在是我电脑桌面。梦境这东西,本身就是最好的艺术狂想脚本,只是得挑着用。

常见问题

记不住梦的细节怎么办?

醒来的九十秒内记关键词就够,五个词:地点、主体、动作、光线、情绪。全细节反正AI也用不上,五个词反而逼你挑出画面核心。

草图垫图强度多少合适?

0.35到0.45。低于0.3草图基本被忽略,高于0.5成图会带着草图的潦草感。我固定用0.4起手,翻车再动。

梦里的人物脸怎么处理?

别试图还原梦里那张脸,它本来就不存在。给身份和动作就够——「穿蓝外套的邮差弯腰捡信」,脸交给AI编,比强行回忆靠谱。

纯情绪的梦真的一点办法没有吗?

只能绕行:把情绪翻译成一个象征物。焦虑的雾化成「雾里生锈的旋转门」,出图就有抓手了。直写情绪词,出图永远平庸。

延伸阅读