AI 延伸绘画扩图实测:方图延成横幅,翻车三次才摸到门道
我的判断是:扩图补的是环境,不是主体。每次只向外扩四分之一,接缝才藏得住。一张猫片被我扩废三次之后才总结出这套笨办法,主体贴边、画面带字的图,劝你直接重画,别扩了。
把一张1比1的猫片交给AI 延伸绘画拉成16比9桌面横图,出来的第一版把我笑出声:猫的脸没事,身子被拉成了年糕,右边还多出半条来路不明的尾巴。笑完老实坐回来研究,扩图这事看着是无脑拉画布,其实全是判断题,往哪扩、补什么、什么时候该放弃。三次翻车之后,总算攒下几条能复用的门道,顺手写在这了。
扩图前先想清楚补什么,而不是延多少
扩图方向要提前规划:补环境不补主体,天空、地面、墙面这类大面积背景最好补,每次只向外扩四分之一。一步到位扩满,翻车率直线上升。
第一次我贪快,直接把1比1的画布拉成16比9,让AI一次补齐两侧。结果左边凭空多出一扇窗,跟原图的客厅完全对不上,右边那只多出来的尾巴就是这轮的产物。第二次改成两边各扩四分之一,补完再扩,画面就稳了。原理不复杂,AI补图靠猜,每次给它的未知区域越小,它能参考的原图信息越多,猜得越准。跟拼图一个道理,一次拼一块,总比一次拼十块靠谱。
还有个前置动作别省,扩之前先检查原图边缘。边缘上有被裁断的物体,比如半只杯子、半根栏杆,扩图时AI大概率给它们续上一个奇怪的结局。我现在的习惯是扩图前把这类裁断物手动修掉或者干脆裁掉,画面干净了,AI要瞎编的方向也就少了。
扩图时的提示词也别空着,我会把原图里已有的风格词原样带上,水彩就写水彩,夜景就写夜景,再补一句画面向左右自然延伸。AI补新区域时全靠这些词定调,你留空,它就自由发挥,自由发挥的后果你已经见过了,那半条尾巴就是它自由发挥的杰作。
三次翻车:鬼影、复读机、越补越糊
边缘鬼影来自贴边的主体,复读机式的重复来自规则排列的物件,这两个坑都能靠改原图或分步扩避开。
鬼影那次,原图里猫的耳朵尖几乎顶到画框上沿,扩出来的区域在耳朵旁边印出一个半透明的重影,跟闹鬼似的。把原图裁掉一条边,让主体离画框留出空隙,重影就没了。复读机那次更绝,我扩一张城市天际线,AI把同一栋楼往右复制了三遍,间距整齐得像排队做操。对付规则物件,扩图提示词里要写明变化,比如远处楼群高低错落,或者干脆换个种子重跑。
越补越糊是第三坑,扩两轮之后新区域的细节明显比原图肉。后来我改成扩完统一做一遍低重绘幅度精修,幅度压到0.3左右,糊的问题能救回来大半。精修时只动新扩的区域,原图部分锁住蒙版,别让AI把手伸回原来的画面。不夸张地说,这步精修才是扩图流程里真正的收尾工序,跳过它,前面扩得再好也白搭。
对了,扩图比例也有讲究,1比1扩3比2,比扩21比9靠谱得多,比例越极端,AI要编的内容越多,编瞎话的概率也越大。真要超宽幅,老老实实分三四轮扩,别指望一口吃成。
这三种图别扩了,重画一张更快
主体贴边、画面带文字、人脸靠边站的图,扩图的修补成本比重画还高,直接劝退。
我拿三张图做过对照。主体居中的猫片,扩图两轮搞定,效果能打。海报截图带字的,扩出来的区域文字全糊成蚯蚓,后期补字的时间够重画两张。还有一张人像,脸在画面边缘,扩完脸被AI脑补歪了,怎么调都救不回来。所以现在拿到图先问自己一句:主体离边远不远?远了再扩,近了趁早重出一张,别跟工具较劲。
顺带一提,重画也不是从零开始。原图可以直接当参考图喂回去,把画幅和构图要求改一改,出一张同款横版,主体一致性比扩图还高。这个办法我最近用得比扩图本身还勤。改画幅的时候构图词也要跟着改,别只改比例数字,我重画横版时会把竖构图改成横构图,只改比例不改构图,出来的图经常还是挤在中间一条。
那张16比9的猫片最后还是挂上了我的电脑桌面,第三版的。回头看这三次翻车,其实都栽在同一个地方:我以为扩图是拉长画布,实际它是让AI看图编故事,你给的线索越清楚,它编得越不离谱。下次动手前,先把往哪补、补什么想好,能少走我这三步弯路。这三条经验没有一条是高深的,全是废图堆出来的。
常见问题
扩图的接缝能完全看不出来吗?
分步扩加低重绘幅度精修之后,大多数接缝肉眼已经难辨,但放大到百分之百还是能找到色阶断层。要求高的图,建议在接缝位置用修复画笔再扫一遍,或者干脆让扩图边界落在天空、墙面这类纯色区域上。
有没有免费的工具能做延伸绘画?
有,不少开源界面自带扩图功能,在线工具也有少量免费额度。效果差距主要在重绘幅度和边缘控制,不在有没有这个功能,先用免费的练手完全够,摸清分步扩的节奏再谈换工具。
扩出来的区域商用要注意什么?
新区域是AI生成的,商用前确认所用平台的授权条款,涉及人物的还要留意肖像问题。我的习惯是扩图区域尽量只补风景和物件,避开人脸和商标,省掉一大半麻烦。