ai绘画长图怎么做:比例怎么选、多段怎么拼的实测做法
先把长图讲透:长图和横幅不是一道题,比例由展示端说了算,选错了后面拼得再细也救不回来。多数模型单段出图有清晰度上限,硬拉分辨率必糊;稳妥路线是按用途定比例,超出上限就分段生成再拼。动手前先确认这张图最后躺在哪里。
用 ai绘画 做长图,第一件事不是憋提示词,是定比例和尺寸。横幅想铺满网页头部,竖图想让人在手机上刷很久,这两个方向的画质极限完全不同。我自己的结论只有一句:单段能装下的就单段出,装不下的老老实实分段拼。
为什么值得专门写一篇?因为我翻过不少车。一张 3072×768 的横幅直接硬出,文字元素十张里崩九张;一张竖版条漫拉到 2048 长边,人物手指糊成一团。这些都是花过时间才换来的教训,下面的数据都来自我在本地 4070 上跑的实际对照,你照着选可以少走弯路。
比例怎么选:先看这张图最后躺在哪里
比例由展示端决定:手机条漫和长图选 9:16 起步,网页横幅选 21:9 或 3:1,普通分享图 4:3 就够。超出模型清晰度上限的部分靠拼接补,别指望硬拉分辨率。
我把常用场景整理成一张对照表,尺寸是本地 SDXL 实测的稳妥区间:
| 用途 | 建议比例 | 单段尺寸参考 | 实测表现 |
|---|---|---|---|
| 手机条漫、竖版长图 | 9:16 | 1024×1820 上下 | 细节基本在线,10 张里 8 张可用 |
| 公众号配图长图 | 3:4 或 2:3 | 1024×1536 | 最稳的一段,文字都还能认 |
| 网页头部横幅 | 21:9 | 1536×640 附近 | 10 张里 7 张能直接用 |
| 超宽 banner、头图 | 3:1 及以上 | 不建议单段直出 | 透视和文字崩得厉害 |
同一套提示词,我跑过一组对照:1024×1024、1024×1536、1024×2048 各出 10 张。1536 长边那组有 8 张细节在线;拉到 2048,手指开始糊,10 张里 6 张翻车。宽度方向更惨,3072×768 那组,画面里但凡有招牌、路牌,字基本全崩。这不是玄学,是模型训练分辨率的天然边界。
所以判断顺序很简单。先量展示位,再查目标比例有没有超出上面的稳妥区间。没超,直接出;超了,就进下一节的拼接流程。
多段拼接:重叠留够,风格钉死
多段拼接的核心就两件事:相邻两段留 15% 到 20% 的重叠区,配合固定种子和统一风格词压住色调。接缝用重叠区做过渡,比硬对齐快得多。
分段提示词有个口诀:首段定调,后续复述。第一段把场景、光线、画风写全;第二段开始,环境关键词照抄一遍,只改动画面主体。偷懒不复述的话,第二段的色调立刻漂。我试过一张山景横幅,第二段忘了写「黄昏暖光」,出来直接变成冷青色,整条横幅像从中间被人换了滤镜。
拼接的具体做法有两条路。路线一是垫图续画:把上一段的尾部裁出来当 img2img 的底图,重绘幅度压在 0.4 到 0.55 之间,模型会顺着已有内容往下延。路线二是局部重绘(outpainting):整段先生成,再向四周扩展画布。我更推荐路线一,可控性强,尤其在人物和建筑这类强结构内容上。
重叠区怎么用?两段拼好后,接缝落在重叠带里,用修图工具沿边界做羽化过渡就行。180 像素左右的重叠带,羽化 30 到 50 像素,肉眼基本看不出痕迹。最后用 ImageMagick 的 append 一键纵向拼合,几秒钟的事。
再说种子。同一段提示词、同一个种子,模型输出高度一致,这是压住画风的关键。我的习惯是整条长图共用一个种子,只在分段主体上换描述词。跑了十几条长图下来,这条经验没失手过。
翻车实录:三处高频断裂点
长图最常见的三处翻车:接缝色差、主体重复、透视断裂。修法分别是垫图过渡、写明唯一主体、分段边界避开强透视线条。
色差上面说过了,垫图能治。主体重复更隐蔽:我做过一张 9:16 的山涧瀑布长图,分三段生成,结果出现三层长得几乎一样的瀑布。修法是在分段词里明确位置序列,比如「画面顶部为源头、中段为跌水、底部为深潭」,一段只许一个主体。改完 10 次里 9 次正常。
透视断裂最折磨人。走廊题材的长图,第二段的灭点偏了差不多 15 度,接缝处墙面直接错位。后来我学乖了:分段边界尽量切在天空、水面、纯色地面这类弱结构区域,避开栏杆、地砖缝这种强透视线。切对了位置,拼接难度直接降一半。
个人觉得被低估的一个技巧是「先小样后放大」。整条长图先按缩小版拼一遍草稿,确认色调和结构连贯,再回头出高清分段。多花十分钟,能省掉整条重做的风险。
回头看开篇那句话:先定比例,再谈生成。竖版长图守着 1024×1820 的稳妥线,超宽横幅别硬拉,交给分段拼接和重叠过渡。这套流程我跑了一个多月,从条漫到 banner 都趟过一遍,稳定性远比单段硬出高得多。
常见问题
直接把生成尺寸拉到 4096 长边不行吗?
部分工具支持超分放大,但那是放大已有内容,不是补充新细节。长边拉太高,画面会先糊后崩,比例太极端时还会出现肢体复制。分段拼接才是正路。
拼接用什么工具最省事?
纯拼合用 ImageMagick 的 append 命令一行搞定;接缝羽化用 PS 或免费的 Photopea;批量做条漫的话,写个十行的 Python 脚本自动化,一次配置长期受益。
横幅里必须带文字怎么办?
别让模型画字。留出空白区域,文字后期用排版工具压上去,可控性和清晰度都完胜直出。实测直出文字在超宽比例下崩率接近九成。
条漫里人物前后长得不一样怎么破?
三招合用:人物特征词每段原样照抄、全程锁种子、第二段起用首段人物特写做垫图。我按这个组合连出过 12 段的角色条漫,脸型基本没跑。