ai绘画hanabi怎么画才不假?烟花爆开层次、水面倒影、人群背影全拆开讲

ai绘画hanabi怎么画才不假?烟花爆开层次、水面倒影、人群背影全拆开讲
ai绘画hanabi夏日祭烟花大会,夜空烟花多层爆开,水面倒影与人群背影

先等一响,再谈ai绘画hanabi:这类图好不好看,七分押在爆开层次和水面上,三分才轮到烟花本身。只画一朵大花的图基本是废的,你先拆三层光,再去磨倒影和人群背影,顺序反了全白干。

ai绘画hanabi这题我练了小半个月,结论先撂这儿:烟花本身是最好画的部分,真正决定真假的是夜空、水面、人群这三层的配合。河滩上等烟花的那个傍晚,最动人的画面其实出现在第一响炸开之前——人群的背影静着,水面黑着,天还剩一线橘。模型对这种"安静的爆炸前夜"理解得很差,你不写,它就给你塞满一朵接一朵的花,热闹得像年画。

所以我的做法是分层喂词。天空一层、水面一层、人一层,谁也不抢戏。下面挨个说。

夜空的烟花,爆开层次为什么至少写三层

一朵真实感在线的烟花至少三层:核心亮斑、中层飘落的火花丝、外圈已经发暗的余烬。少一层就假,模型默认只给你第一层,剩下的两层必须用词明明白白要。

我最早翻车就翻在这。写 "hanabi fireworks in night sky",出来一朵巨大的蒲公英,中心一团死白,边缘齐得像用圆规画的。后来对照真烟花的照片看明白了:真烟花炸开以后,火花是往下坠的,坠着坠着就暗了,最外圈那些只剩一点点橘红色的渣。这个"由亮到暗的坠落过程"就是层次。

提示词我现在的写法是三段连击:"bright的核心词 + 火花丝 + 余烬",具体是 "radiant core, trailing sparks falling, fading embers"。顺序有讲究,核心放前面模型权重给得足。还有一个野路子:在负面词里塞 "single burst, dandelion"(单次爆开、蒲公英),我测下来蒲公英这个词负面效果意外地好,出图的花形立刻散得自然。

采样步数我固定在28往上,低于25的时候火花丝会断成虚线,像信号不好的烟花直播。CFG 7左右,调太高烟花的边会硬化,一圈一圈像切开的洋葱。这些数字别照抄到死,你的底模不一样,浮动两三步都正常,方向对了就行。

顺嘴跑个题。有天夜里我盯着真烟花的视频逐帧看,发现爆开后大概第0.5秒到第1秒,火花会集体往下一沉再散开——这个"沉一下"的节奏感,模型天生不懂,只能靠 "sparks drooping before scattering" 这种词去勾。加了以后我的出图突然有了一种下坠的重量感,朋友看了说像小时候在老家河堤上看的那种土制烟花。要的就是这个。

水面倒影怎么画才不像铺了块镜子

倒影的核心不是对称,是破坏对称:拖影长度压到实景的0.4倍上下,再让涟漪把它切碎,倒影才会活。完整的镜像一出现,观感立刻降级成贴图。

模型对水面倒影有个顽固偏好:给你来一份完美的上下对称。物理上这就错了。看烟花的人站的是河岸,河面永远有风、有船、有上游下来的碎波,倒影是被拉长、抖散、染脏的一团光。我现在的公式是 "shimmering reflection, broken by ripples, elongated light trails",实测拖影的长度提示写 "reflection takes about half the height of the burst" 比写完整镜像好得多。

还有一个跟季节抢戏的细节:夏日祭的河面常有捞金鱼的水桶、屋形船的灯。往倒影区里加一两处杂光——比如 "lantern light smearing on water"——烟花的主倒影反而更突出。全画面只倒影烟花一种东西,假;倒影里混着不属于自己的光,真。

翻车记录也得交一份。有一版我把涟漪写太狠,"rough water, big waves",出来的倒影像开水煮沸了,烟花在水里的像碎成雪花噪点。改回 "gentle ripples, calm river surface with slight breeze" 才稳住。涟漪要的是"碎",不是"浪",这两个词差着十万八千里。

构图上倒影区我一般留给画面下三分之一,烟花占上二分之一,中间那一线河岸挤下人群。比例卡在大概1比0.45,怎么调怎么顺眼。

看烟花的人群背影,为什么宁可小也不要正面?

人群背影是画面的情绪锚点,人一转正面,烟花大会就变成了烟花展览。背影写小、写剪影、写局部的后脑勺和浴衣肩线,观者的视线才会顺着人望向天空。

我自己吃过的亏:早期出的图,人群一律面向镜头,笑容满面,手里还举着苹果糖——像是在给烟花拍合影,完全不对。真实现场没人回头。后来负面词里直接锁 "facing camera, looking at viewer",正面只留零星几个"转身买小吃"的侧面,主体全是背影。

背影要写出可看的细节。浴衣的肩线和腰后的结、小孩骑在父亲脖子上举着扇子、情侣之间那半只手的距离——这些词每个都不长,加两三个进去,人群就从"贴在画面下沿的色块"变成了"站在河滩上的活人"。密度也有说法,人群靠画面下沿密、往远处疏,写 "dense crowd in foreground silhouettes, sparse figures along the bank" 比均匀撒人自然得多。

参数和翻车值放一张表,方便对照改自己的提示词。

项目我现在用的写法/值翻车时的写法/值差在哪
爆开层次核心亮斑+火花丝+余烬三段连写只写 fireworks in sky少了坠落的暗部,花形发死
采样步数28-3020火花丝断成虚线
CFG7左右11烟花边缘硬化像洋葱圈
倒影拖影约0.4倍实景高,涟漪切碎完整镜像 / 滚开的水前者像贴图,后者像沸水
人群背影剪影+浴衣细节,下密上疏全员面对镜头微笑现场感直接归零

再提一嘴负面词的用量,别贪多。我见过有人负面词塞几十个,模型被捆得手脚全无,连烟花都画不圆了。我的负面词常年压在十个以内,只锁真出过问题的。

回到开头那个"先等一响"的时刻。一张能让人看住三秒的hanabi图,炸开的那朵花只占三分,剩下七分是烟花没响之前的安静:黑着的水、静着的人群背影、天边最后一点橘。爆开的三层光给你兜住花形,0.4倍的拖影给你兜住水面,剪影人群给你兜住情绪——三层齐了,这张图才像真的有人站在那个河滩上,屏着气,等第一响。

常见问题

hanabi这个词要不要直接写进英文提示词?

可以写,但别指望它单独起作用。模型对 "hanabi" 的响应弱于 "fireworks",我一般两个都写,hanabi放在前面沾一点和风的权重,再靠 "summer festival, yukata" 把场景拽到日本夏日祭那边,单靠一个词是拽不动的。

为什么我画的烟花总像蒲公英或者绣球?

花形发散得太均匀,就是少了前面说的坠落层次。负面词加 "dandelion, uniform burst",正面补 "trailing sparks, fading embers",两步一起做。只做正面那一半,改善很有限,这个我试过。

横构图和竖构图怎么选?

竖构图给天空和倒影的纵向空间多,适合表现一朵大烟花的完整坠落;横构图适合人多的场景,能铺开整条河滩的背影。我出图横竖各跑一版,十次里七次留横版——人群的戏比烟花的个子更耐看,这是个人偏好。

倒影里的烟花颜色要跟天上的一样亮吗?

不一样,必须压暗。倒影词后面跟 "dimmed, blurred reflection",亮度打七折左右观感最对。水里那团光一旦和天上等亮,画面就会像两张图上下拼接,一眼穿帮。

人群画多少人才算合适?

没有死数,看画面下沿留了多宽。我的经验是近景能数出十来个完整背影、远处糊成一片剪影就够了,超过三十个清晰人形,模型开始在手部和衣纹上出错,反而露怯。

延伸阅读