AI绘画眼中的好图长什么样?蹲了一个月的审美偏好观察
有话直说:AI绘画是有审美舒适区的,柔光、规整构图、干净背景是它的默认审美,跟它对着干要费劲,顺着摸能省一半力气。我把一个月六百多张出图翻了个底朝天,它的偏好、我的反向实测和顺势用法,全在这篇里。
AI绘画眼中,什么样的图算好图?这个问题听起来玄,其实能统计。我有个雷打不动的习惯,所有出图连废稿一起按月归档,上月底一数,十月十一月攒了六百四十多张。闲着也是闲着,我把它们按光线、构图、画面整洁度粗粗分了类,想看看这东西的"口味"到底长什么样。
统计完的第一感受:它不是没有审美,是审美非常偏向某一种"标准答案"。像刚毕业的影楼助理,技术不差,但什么都往"体面"里拍。
它的舒适区:柔光、三分法和永远收拾干净的房间
AI绘画的默认审美偏爱柔光、平衡构图和整洁背景,人脸几乎清一色四十五度柔光,混乱场景会被它自动"整理"。这些偏好写在训练数据的平均值里。
光线上的偏心最明显。六百多张里,人物图绝大多数是柔化的伦勃朗式布光,脸的一侧亮一侧过渡柔和,硬光直打的面孔屈指可数——还是我在提示词里反复强调"hard light"才换来的。它像怕伤着模特似的,什么光都要包一层柔布。
构图上,主体不是压在三分法交点上,就是稍微偏一点点但绝不出格。我专门翻了我那些翻车图,构图失控的几乎都伴随其他问题,单纯"构图乱"的图,一百张里挑不出三张。
最有意思的是"整洁强迫症"。我出过一组题叫"乱糟糟的年轻人出租屋",十张图里八张地面干净、书摞得整整齐齐,乱是装出来的乱,摆拍式凌乱。剩下两张有点样子,也是"艺术家的乱",不是"加班回来的乱"。训练数据里的房间图大概都来自室内设计网站,它见过的"家"全是样板间。
把它拽出舒适区:反向词实测清单
想破掉AI的默认审美,用反向偏好词最有效:硬光、失衡构图、生活杂物、过曝欠曝都值得一试,代价是废图率上升。每加一个反向词,多备三轮抽卡预算。
我逐项试过。硬光组:加"harsh noon sunlight, sharp shadows"(正午硬光、锐利阴影),出图立刻有了纪实摄影的糙劲儿,代价是十张里六张人脸崩,硬光连带的皮肤纹理它不太会处理。
杂物组:在房间题里追加"外卖盒、缠绕的数据线、晾在椅背的袜子",画面可信度上一个台阶——虽然袜子它画了三次才画对位置。这张"真乱"的出租屋后来成了我那组图里最被夸的一张,评论区说想起了自己刚毕业那会儿。
失衡构图组最玄学。"主体挤在画面边缘、大面积空黑",成功时非常有电影感,失败时直接头被裁一半。我的经验是这类词配低一点的重绘幅度用,稳一些,大概能把成功率从两成拉到四成。
反着用不如顺着用:什么时候该顺毛摸
商业图、头像、说明书式配图就该顺着AI的默认审美走,稳定干净是优点不是毛病;创作向的表达才值得花废稿去对抗。分清场景,别跟自己的效率过不去。
有一说一,舒适区不是缺点。我给公众号出的题图、给同事做的头像,要的就是干净体面不出错,这时候它那种"影楼审美"正好,我甚至不再写光线词,让它自由发挥,反而次次稳定。
真正值得对抗的场景是叙事性的图:想让人闻到生活味的场景、想让人心里一沉的氛围。这类图里,"完美"恰恰是败笔。我现在的判断标准就一条——这张图是要"好看",还是要"真"?要好看,顺毛摸;要真,准备好废稿。
蹲完这一个月,我对"AI有没有审美"这件事的回答是:它有,但那是几百万张别人照片投出来的影子。你想让它说出自己的话,得先逼它离开平均值——这事说难也难,说简单也简单,看你舍不舍得那几张废稿。
统计做完那天晚上,我把六百多张图快速翻了一遍当收尾,像看完一部关于平均值的长片。最扎眼的还是那几张硬光乱房间的图,糙,但记得住。AI绘画眼中的好图是它被喂出来的答案,而你要的答案,得自己去拽。
常见问题
反向词放提示词什么位置效果最好?
放前面权重更高,但崩图率也跟着涨。我的习惯是放中段,先保住主体,再让反向词起作用,废图率好接受一些。
为什么AI画的房间总是那么干净?
训练数据里的室内图大量来自设计网站和房产摄影,本身就是样板间标准。想要生活味,必须把杂物一件一件写进提示词。
顺着AI默认审美出图,会不会千篇一律?
单张看不会,放在一起会。如果整组图都是一个光源一个构图套路,观众一眼就腻,同组里记得主动换两三张破一下。
统计出图偏好需要很多张吗?
不用六百张,两百张左右就能看出明显倾向,关键是废稿也要算进去,只统计成功图会高估它的多样性。