AI 未来绘画别堆霓虹:我把2050画成早点摊

AI 未来绘画别堆霓虹:我把2050画成早点摊
市井烟火气的未来街道AI绘画场景

说重点:AI 未来绘画被霓虹蓝紫绑架太久了,五十张投稿里四十一张长一个样。我换成「市井未来」的画法——旧物件加一个新元素,同参数对照实验里盲选一边倒。未来不该只有高楼,也该有早点摊。

上个月朋友办了个线上画展,主题就是AI 未来绘画,收了五十多张图。我把它们按顺序翻完,产生了一种时间错觉——这五十张图,起码有四十一张是同一个世界:蓝紫霓虹、飞行器、湿漉漉的街道,个体站在巨大广告牌下面。不能说难看,是太像了,像到第二十张之后我开始机械滑动。

散场后我跟朋友说了一句挺欠揍的话:你们画的未来怎么比现在还无聊。他回我:那你画一个。于是有了这篇。

未来图为什么千篇一律

训练数据里未来题材的图大多长一个样,你写「未来城市」,模型吐出来的就是数据里出现频率最高的那个未来。词越概括,图越像别人画过的。想不一样,得把词换成具体的物件。

我验证过这件事。同一天、同一个模型、同一批参数,第一批提示词写「未来都市,霓虹,高楼,飞行器」,十张;第二批写「清晨的街边早点摊,竹蒸笼冒热气,一只机械手在收纸币」,十张。第一批二十张里能记住的,两张;第二批,六张。差距不在技术,在词的具体程度——「未来」是个谁都能脑补的筐,竹蒸笼是只有你想得到的细节。

还有个更隐蔽的原因:霓虹夜景其实是偷懒的方案。黑底加发光,怎么画都不出错,模型的容错率极高。而白天的、有烟火气的场景,光影和材质处处是考验,模型翻车多,人也不敢试。省事的路走的人就多,这是规律,放在哪都成立。

不画霓虹,未来还剩什么?

剩的全是生活:一个旧物件加一个新元素,就是一条完整的市井未来公式。竹蒸笼配送餐无人机,老公交站配悬浮线路牌,早点摊配扫码的机械臂,新旧撞在一起,未来感自己就出来了。

这个公式我实测了三组,每组至少跑八遍,出片率最高的是下面这些搭配:

  • 「清晨早点摊,竹蒸笼,白色蒸汽,一架小型送餐无人机悬停取餐」——最稳的一组,蒸汽给画面加了呼吸感。
  • 「老小区公交站,搪瓷缸字样的站牌,旁边立着半透明的悬浮线路图」——新旧对比最扎眼的一组。
  • 「修车摊,老师傅蹲着修悬浮滑板,工具还是那套扳手」——人物最有戏的一组,翻车也最多,手。

翻车记录必须留一笔。我让无人机「叼着一袋豆浆」,出来三张,两架无人机直接把豆浆连袋吞进了机身,另一张豆浆袋子长出了旋翼,飞走了。后来改成「无人机下方悬挂着豆浆袋」才正常。另外「机械臂煎饼摊」这个词,我一共跑出两根带电线的薄脆,画面荒诞得像是故意的,那张图我到现在还留着。

参数上有个小经验:这类图我普遍把写实质感词降一档,用「插画感」或「柔和光」,写实词拉满的话,新旧物件会互相打架——蒸笼的纹理比悬浮屏还锐利,看着别扭。

两批图的盲选结果和我爸的一句话

我把霓虹组和市井组各挑五张发给十个人盲选,市井组拿了二十九票对二十一票,赢在「想住进去」这一条。技术分接近,输赢全在情感钩子上。

盲选我问的是同一句话:哪张你想多看十秒。选市井组的人给的理由高度一致——「像真的会发生事的地方」。有个学建筑的朋友说得更狠,他说霓虹组那些图「是把现在的图调了个色温」。这话挺伤人,也挺准。

最有分量的反馈来自我爸。他平时对我的图一律评价「挺好」,那天路过瞥了一眼早点摊那张,停了两秒,说:「这不就是咱楼下那个摊吗,再过三十年也这样。」——正是我要的东西。未来的想象力,不在飞多高,在「日子还在过」。技术会变,早点摊的蒸汽不会。

这组实验做完,我把自己仓库里存的三十七张霓虹图删得只剩五张。倒不是它们烂,是我发现自己在用它们偷懒:想不出词的时候,「未来都市」四个字一打,交差了。

画展的事后来有了下文:朋友把市井未来定成了下一期的主题。我不知道这个套路能流行多久,说不定明年满屏都是蒸笼和无人机,到时候又得换。但有一个判断我敢先放这儿——AI 未来绘画拼到最后,拼的不是谁想得更远,是谁想得更具体。先去你家楼下看一眼,回来再动笔。

常见问题

市井未来适合做系列图吗?

特别适合。早点摊、公交站、修车摊、菜市场,一套词框架换场景就能成系列,新旧对比的基调统一,连贯性比单张好做。

写实风格画市井未来效果好吗?

能出,但建议质感词收一档。写实拉满时新旧物件的质感容易失衡,插画感和柔和光是更稳的选择。

这类图会被误认为真实照片吗?

少见,但涉及真实街景和店铺样式的,发布时标注AI生成更稳妥,尤其是商用的图。

新手先从哪个场景练起?

推荐早点摊那组,蒸汽和暖光容错率高,翻车率是三组里最低的,第一张图的成功率很重要。

延伸阅读