原点ai绘画复盘:重画出坑第一张图,我看见了两年的代差和自己

原点ai绘画复盘:重画出坑第一张图,我看见了两年的代差和自己
原点ai绘画对比:旧显示器里的颗粒感霓虹便利店与新屏幕上重画的高清版本并排

先翻旧图,是这次实验的全部起点:把入坑时出的第一张AI绘画连同提示词原样挖出来,一个字不改,丢给现在的模型重roll五次,再和旧图并排比。图的差距是明摆着的,手指、文字、光影都被新模型治好了;更值钱的是两张图之间那个变化的自己。建议你也挑一张旧存档照做一遍,半小时就够。

原点ai绘画这个词,在我这里不是概念,是一张具体存档:2024年3月17日凌晨,一台老模型出的雨夜便利店。短发女孩,白色卫衣,霓虹招牌,胶片质感。为了等它,我连抽了四十多张废图,凌晨一点半才存下这张能看的。那天晚上我认定自己入坑了。

前几天整理硬盘又翻到它。一时兴起,把当年那句提示词原封不动贴进新模型,重roll了一遍。旧图里糊掉的手、乱码的招牌、歪掉的眼睛,全被接住了。可是盯着并排的两张图,我心里冒出来的第一句话居然是——旧图好像更让人高兴。

这不是怀旧滤镜。往下看你就明白我的意思。

同一句提示词,隔两年各交了什么作业

同一串提示词重roll五次,新模型四次输出几乎同构的成品,老模型五次里三次翻车,稳定性和惊喜感是两个时代。为了公平,我连采样器设置都尽量对齐了,唯一的变量就是模型本身。

先说2024年那次的原状:512×768的画布,28步采样,CFG拉到7,负面词塞了整整一行半——低质量、畸形手指、多余肢体、水印、模糊,十几个词排着队。单张出图约9秒,我挂机出了四十多张,挑中那张便利店。翻车率大概七成,这在当时是常态。

这次重roll:同尺寸思路直接升到1024×1536,20步,负面词一栏我空着没填。第一张就可用。连出五张,张张能交差。但有个细节让我愣了一下:五张里四张的构图几乎一样,女孩都站在画面偏左,招牌都在右上。新模型稳定得像流水线,连惊喜一起收走了。当年挂机抽卡的乐趣,一半来自它不靠谱。

对比项2024年3月老模型2026年新模型
提示词一句主描述+十几个负面词同一句,负面词留空
尺寸512×7681024×1536
采样步数28步20步
单张耗时约9秒约15秒
五次重roll结果3次废图,2次可用5次可用,4次构图雷同
招牌文字乱码直接写出「深夜食堂」

那阵子大规模抽卡的账我后来单独记过一笔,连风格分布和废图排行都数过,感兴趣可以看这篇ai 绘画200张出图复盘:风格分布、积分总账和废图排行榜一次看全,两相对照挺有意思。

肉眼可见的代差,集中在三个地方

手指和文字是最狠的两道分水岭,光影层次排第三;旧图靠裁剪和后期遮丑,新图直接交卷。这三处差距,隔着屏幕都能一眼认出来。

手。旧图里女孩的右手搭在冰柜上,四根手指,多出一节没有来由的关节,指缝糊成一团。当年我裁掉了半个手掌才敢发出去。新图五指分明,连指甲上的霓虹高光都点出来了。两年前谁敢想。

文字。旧图的招牌是蚂蚁打架,一堆没有意义的笔画挤在一起,远看热闹,凑近全是乱码。新图把「深夜食堂」四个字写得端端正正,笔画粗细都对。我第一次见到能写字的图时,反复放大看了半分钟。

光。旧图的霓虹是一坨红,糊在背景里。新图会在卫衣袖口描出一线反光,地面水洼里的倒影有形状、有虚实。当年提示词里写了「胶片颗粒」,老模型只给了均匀的噪点;现在连颗粒的疏密都有节奏,亮部密、暗部松,像真的过期胶卷。

有意思的是,这些「进步」也顺手拿走了点东西。旧图的噪点是模型算不准留下的意外,新图的颗粒是算准了画给你的。前者是毛病,后者是风格。隔着两年的审美,看法完全不一样。

审美被拉开的变化,比模型升级更值得看

当年拼手气抽卡,看谁都美;现在先定构图和情绪再出图,废图率降了下去,命中预期的惊喜也少了。技术替你省下的时间,一半被你花在了更挑剔的地方。

两年前我存了两百多张图,当宝贝。现在回头数,真正愿意留下的不到二十张。旧图当年在我眼里哪里都好——霓虹反光、发丝、雨夜氛围。这次翻出来重新看,第一眼就是:手不对,右眼比左眼高半格,构图人物死死居中,平得像证件照。审美标准被新模型养刁了,这一点藏不住。

习惯也全变了。当年提示词后面跟着一串质量词,best quality、masterpiece,堆得越长心里越踏实,像烧香。现在我写大白话短句,把力气花在「她为什么深夜站在便利店门口」这件事上。当年CFG恨不得拉满,怕模型不听话;现在宁愿调低,留点空间让它自由发挥。

还有一个我自己都没料到的变化:出图快了,人反而慢了。慢在想。当年四十连抽里捞一张能用的,靠运气,不费脑子;现在出图前三分钟都在纸上划拉构图——机位低一点还是高一点,招牌入画多少,女孩看镜头还是看雨。真正按下生成前,图在心里已经出过一遍了。

打个可能不太恰当的比方:小时候第一口可乐是神仙水,现在喝出的是糖浆。可你要问我怀念哪个,我两个都要。

你也想给自己做一次这样的回放吗

翻图、抄词、一个字不改、并排摆开、写下三点差别,半小时就能给自己做一次原点回放。这套动作没什么门槛,一台能出图的设备就够。

步骤照抄就行。第一步,翻出你入坑最早还留着提示词的那张图,原图比截图好,截图压缩过。第二步,把提示词、负面词、尺寸、步数全部抄下来,一个字别改——改了,变量就不止模型一个,对比就作废了。第三步,用现在的模型按原词出五张,取中间水平,别只记最好那张。第四步,新旧并排摆开,逼自己写下三条具体差别,写「更清晰」不算数,要写到手指、文字、反光这种落实处。第五步,顺便问自己一句:当年觉得这张图神在哪,现在还认吗。

第三到第五步才是真东西。图谁都会出,差别写不写得出来,才是审美长没长进的证据。

实验做完,两张图我都留着,谁也没替换谁。并排贴在收藏夹最上面,左边那张烂得真诚,右边这张好得标准。模型明年还会再升级,到时候我大概还会把这张便利店翻出来,重roll一遍。原点图不用好,它只需要一直在那儿。

常见问题

旧提示词直接喂给新模型,需要先改写吗?

第一遍不要改。原样跑一次,对比出来的差距才全部归功于模型本身;等看完差距,再按新模型的习惯做增删,那是第二轮实验的事,别混在一起。

同一句词重roll多少次才有对比意义?

我的经验是五次。一次两次是碰运气,十次以上容易只记住最好那张、抬高对新模型的预期。五次取中间水平,比较接近真实能力。

新模型出的图反而没味道,是我提示词写错了吗?

多半不是。旧图的「味道」很多来自缺陷——噪点、错字、歪构图,模型算不准时白送你的。想把味道找回来,就把缺陷当风格写进提示词:胶片颗粒、轻微过曝、倾斜机位,都能要回来一些。

早期的图值得全部重画一遍吗?

挑三五张有故事的就够了。全库重画等于给自己安排一轮新的抽卡,又累又容易审美疲劳,这活儿本来是为了回望,不是为了刷库存。

延伸阅读