AI绘画生成一张图,新手先把这四个参数弄明白
先把话说在前面:新手卡在生成这一步,九成不是软件问题,是四个参数没搞懂顺序。提示词、比例、数量、种子和重绘幅度,各管一段,先调哪个后调哪个有讲究。这篇按我自己踩坑的顺序讲,数字全是实测。
后台收到最多的提问就一句:为什么我生成的图和别人的不一样。AI绘画生成这件事,按钮按下去只是一瞬,功夫全在按之前的设置里。我把这四个参数掰开讲一遍,你看完再去跑图,废片率能降一大截。
先给个时间基准,免得你心慌。我用现在的国产模型,单张图从点生成到出图八到二十秒,高峰期能拖到一分钟开外。要是等了两分钟没动静,那不是慢,是卡了,直接刷新重来。
从点下生成到出图,中间发生了什么
模型把你的文字转成一组特征,再从一团噪点里一步步"去噪"出画面。你调的每个参数,动的是这条流水线的某一环。
通俗点说,你写下的提示词先被翻译成模型认识的特征编码,然后生成器从一张纯噪点图开始,按你设的步数一步步把噪点擦掉、把内容长出来。这个过程解释了两件事:为什么同样的提示词每次结果不一样——起点噪点是随机的;为什么描述越具体画面越听话——特征编码越清晰,去噪的方向越少跑偏。这话现在听着像常识,当年我是烧了小一百额度才悟出来的。
我第一次搞懂这个流程之后干了一件事:把一段提示词原样跑了二十遍。二十张全不同,但风格底色高度一致,说明随机的是画面细节,稳定的是词决定的骨架。这一趟让我彻底戒掉了"多写几遍总有一张好"的抽卡执念——骨架不对,抽一万次也没用。
四个参数,先调哪个后调哪个
顺序是:先把提示词写扎实,再定比例,再谈数量,最后才碰种子和重绘幅度。反着来,前面全白调。
提示词排第一没争议。我的建议是先写主体和动作,再补光和环境,最后一两个风格词收尾,总长三行以内。新手常见毛病是把一堆词全塞进去,模型端着盘子不知道先吃哪道。我删词实验的结论一直没变过:词少而准,胜过多而全。
比例第二步定,因为它影响构图思路。头像和手机壁纸用9:16,公众号封面用16:9,方图发社群。先定比例再写构图,比出图之后再裁强得多——裁切会把你调好的画面关系全打断。
数量第三步。我的习惯是一次四张:一张太少,看不出模型的波动范围;八张以上选择困难,还费额度。四张里挑一张最好的,记下它的方向,改词再来一轮,两三轮就能收敛到满意。预算紧的话两张起步也行,收敛会慢一轮。
种子和重绘幅度放最后,这是进阶参数。种子管"复现",锁住种子再改提示词,改哪变哪,其余不动,适合微调。重绘幅度管"改动程度",我实测同一构图,0.3只动细节,0.7大改,0.9以上基本换了一张图。微调画面从0.3起步,别一上来就拉满,那等于把前面的功夫全清零。这两个参数藏在高级选项里,好些人没翻到就放弃了。
新手最常见的三种失败,各对一剂药
点不出图查网络和额度,出图不像话查提示词,方向不稳查种子。三剂药各对一症,别乱试。
第一种,点了生成没反应,或者转圈转到天荒地老。十次里九次是网络或额度的问题,先看额度余额,再换网络重试,都不行就等十分钟——高峰期服务器挤是常态。我有天晚上十一点连着失败五次,气得直接睡觉,第二天早上七点重试,一次过。
第二种,图出来了但驴唇不对马嘴。这不是软件的锅,是提示词的锅。回头检查两件事:核心词有没有被长句淹没,有没有互相打架的描述。我见过有人在一条提示里同时写"雪天"和"盛夏",模型左右为难,出来一张谁也看不懂的图,那额度花得最冤。
第三种,大方向对,但每次都差一口气。这种情况最适合上种子参数——挑一张最接近的,锁住种子,一次只改一个词,一轮一轮逼近。走到这一步,你就从抽卡玩家变成精修玩家了。
参数这东西,第一次看觉得繁琐,跑过二十轮就成了肌肉记忆。我现在的流程稳定在:写词、定比例、四张一批、不满意改词重跑,偶尔锁种子微调。整个过程从想法到成图,快的话五分钟。你按这个顺序走两轮,就会发现生成不再是玄学,是道算术题。
常见问题
生成一张图一般要多久?
正常八到二十秒,晚高峰或者新模型刚上线时可能拖到一分钟。超过两分钟没反应基本是卡住了,刷新重试比干等靠谱。
同样的提示词,为什么每次出的图都不一样?
因为每张图的起点噪点是随机抽的,提示词只决定了画面骨架。想复现某一张,把那次生成用的种子值记下来,下次锁住它,画面就稳了。
一次生成多少张比较合适?
我建议四张。少于三张看不出模型的波动区间,多了费额度还容易挑花眼。四张里选方向最对的,改词再来一轮,效率最高。
所有参数都用默认值能出图吗?
能出,但出的是"模型认为你要的",不一定是"你要的"。默认值适合第一次试水,摸清脾气之后,提示词和重绘幅度这两处一定要学会自己调。