ai绘画大作靠抽卡出不来的:分层生成再合成的工程化流程
先把大作拆工:大幅面、多主体、复杂叙事的画面,别指望一句提示词直接抽出来。我按背景、主体、前景分层生成再合成,把成品率从三成拉到八成以上,总耗时反而更短。你现在该做的,是把手头的题目拆成三四层,一层一层来。
这篇说的 ai绘画大作,不是赌运气抽一张让人喊绝的图,而是大幅面、多主体、复杂叙事的大场面图——本篇只讲它的工程化做法:分层生成再合成。思路就一句话:把一张图拆成几层分别出,最后拼回去。
为什么非拆不可?扩散模型一次生成的有效分辨率有上限,主体一多,注意力就摊薄,谁也顾不好谁。上周末我拿 2048×1152 的横幅做了组实测,同一句提示词「黄昏集市,摊位连成排,十来个赶集的人,远处有城门」连跑 10 张:7 张人脸糊成一片,4 张有人多出手或者脚,勉强能看的只有 3 张。这就是硬抽大场面的真实成本。
一句提示词为什么撑不起大场面
扩散模型对全局布局的控制很弱,单次生成超过三个主体,崩坏率会陡然上升,先拆层是唯一稳的路子。
单主体出图,模型只要管一张脸、两只手,10 张里崩一张算正常波动。主体一上五个,模型要在一次去噪里同时安排每个人的位置、朝向、大小和互相遮挡,注意力从「画好一个人」变成「别让十个人打架」,结果往往两头都顾不住。
大幅面还有个更隐蔽的坑。分辨率直接拉高,纹理会出现周期性复制:房子长成双胞胎,一排摊位里同样的竹筐每隔一段重复一次,最离谱的一次是人物肩膀上又探出半个头。这不是提示词写得差,是模型在它没见过的画布尺寸上瞎补。所以别在整图上死磕重roll,路子本身就不对。
分层生成:把一张图拆成几块干活
按背景、中景主体群、前景装饰拆三层,每层单独出图各备三四张,挑好再进合成,别在整图上耗。
具体拆法不复杂。背景层先出,空场景不带人,比例按成品来,出完记下种子号,后面改动不会牵动全局。主体层每个角色单独生成,底色干净一点,四周留白,方便抠图;单人出图的崩坏率低得多,我实测单人 10 张也就一两张手出问题,挑一张能用的太容易了。前景层放树枝、灯笼、屋檐这类边角元素,压在最上面撑纵深。
两种做法摆在一起看,差距很直白。
| 对比项 | 一句提示词直接抽 | 分层生成再合成 |
|---|---|---|
| 人物崩坏率 | 10 张约 7 张崩 | 单人出图 10 张约 1 张崩 |
| 改一处 | 整张重抽 | 只重出对应那层 |
| 总耗时 | 盲抽两小时起 | 40 分钟上下 |
| 可用成品率 | 约三成 | 八成以上 |
一张大作拆四层、每层备三四张,总共十五张上下,比在整图上无限重roll划算得多。有个省力细节:给主体层写提示词时,把背景那句光照描述原样带上,比如「黄昏侧光」,抠完图光影方向天然一致,合成时能省一轮调色。话又说回来,分层也有代价:你得会一点抠图和蒙版,还得对成品有预想,不然各层风格对不上,拼出来像贴纸合集。这个代价下面这一节解决。
合成收尾:光、色、接缝这三关
合成不是把图层贴上就完事,光源方向、色调、接缝三样对齐,再用低幅度图生图把缝隙焊平,才算一张图。
工具用 PS 或者免费的 Photopea 都行,会移动图层、缩放和蒙版羽化三样就够用。摆放顺序是先背景、再主体、最后前景,调整大小和位置时盯住视平线——我第一版就栽在这,人物脚底和对面地面对不上,看着像飘在半空,把主体整体下移再缩一档才贴住地面。
光源方向必须统一。背景是黄昏侧光,主体就得从同一边受光,反了立刻假。色调统一有个省事办法:所有图层上面套一个调色层,色温、饱和度一起拉,各层的「出身」差异能抹掉大半。
最管用的一招放在最后:把合成稿丢回图生图,重绘幅度压在 0.25 到 0.35 之间跑一遍,模型会把接缝、边缘光和琐碎细节自动焊上。幅度别超 0.5,构图会漂,漂了就得重拼。我试了下,这一步能把八十分的拼稿拉到九十分,尤其是抠图留下的硬边,基本一次焊没。
大作不是抽出来的,是搭出来的。回到开头那句:先把大作拆工。背景、主体、前景各管各的,合成时把光和色捋顺,最后低幅度焊一遍缝。流程不难,难的是你舍得花四十分钟拆活,而不是把运气当产能。
常见问题
不会 PS 也能做分层合成吗?
能。Photopea 是免费网页版,移动图层、缩放、蒙版羽化三样功能就覆盖全部需求,照着快捷键练半小时能上手。
各层用什么比例出图?
背景层直接按成品比例出,主体层用 1:1 或 3:4 出完再缩放,主体清晰度不受影响,还更省显存。
多主体之间的互动动作怎么处理?
牵手、递东西这类接触部位别指望各层直接对上,合成后圈个小范围用局部重绘单独补,范围越小越稳。
要拿去打印,分辨率得做到多大?
300dpi 下 A3 需要 3508×4961 像素,合成完用放大工具翻倍起步,细节损失比直接高分辨率生成小得多。
分层法适合所有题材吗?
大场面、多人物最划算;单主体小特写没必要拆,直接出图反而快。