AI绘画回答你需求的过程:审题答题检查一个都不能少

AI绘画回答你需求的过程:审题答题检查一个都不能少
ai绘画回答需求的审题答题检查流程

先把丑话说前面:大部分废图不怪模型,怪你根本没审题。把出图当成一场考试,审题拆需求、逐项答题、交卷前检查三步走齐,我的废图率硬生生降了一半。不信就拿你手里最纠结的那张图试一次。

我一直觉得出图和答考试卷是一回事。高三那年我们数学老师有句口头禅:会做的题丢分,全是没读懂题。后来玩AI绘画,我在自己身上把这句话看了个明明白白——刷了两百多张废图才发现,几乎每张废图都能追溯到同一个毛病:我压根没想清楚自己要什么,就急着往框里塞词。模型没做错,是我没把题目出对。

出图前先审题

审题就是把需求拆成主体、动作、场景、光线、情绪五个槽位,缺哪个槽位,AI就往那里自由发挥。举个我自己的例子。我给一张图写的需求是"画个雨夜便利店",跑出来十张,便利店没一家重样的,人物站位五花八门。后来老老实实拆槽位:主体是深夜加班的年轻白领,动作是撑伞回头,场景是街角暖光的便利店门口,光线要冷暖对撞,情绪是疲惫里带一点释然。拆完再跑,第三张就能用。

你要是不信槽位的威力,做个小实验:同一句话跑十张,记录每一张和你脑子里画面的偏差,把偏差归类,基本都落在那五个槽位里。我归类过自己的三十次抽卡,场景槽位模糊占了十三次,光线没写占了九次。你以为模型不听话,其实是你留了太多空白让它猜。

审题还有个隐藏好处:能提前发现不合理的题。有一回我想画"清晨的夜市",拆到光线槽位才发现自相矛盾——夜市的热闹全靠灯光,清晨大亮着灯就没那个味了。改成"收摊前的凌晨夜市",一次过。题目本身有毛病,跑一百版也救不回来,这个坑只有动笔拆解才看得见。

提示词是答题不是许愿

写提示词要对着槽位逐项作答,正面描述加负面排除一起上,漏答的槽位就是废图的来源。审完题就该答题了。我的习惯是把五个槽位排成一列,每个槽位用一两句具体的词去填,写不出来就说明你还没想好,宁可停下来想,也别拿"高级感""氛围感"这种词糊弄——这两个词我管它们叫许愿池词汇,扔进去等于没答。

负向提示词是橡皮,不是护身符。早期我把别人的负向词表整段抄过来,两百个词里九十个跟我的图没关系。后来学乖了:每次交卷检查发现什么问题,就往负向词里加一条对应的,比如多出来六根手指就加"多指",背景乱入路人就加"人群"。这样攒下来的负向词表,条条都对得上你自己的错题本。

答题的顺序也有讲究,别小看这一点。我试过先写场景再写主体,出来的图环境漂亮但人物像贴上去的剪纸;改成主体永远排第一句,模型对重心的判断明显稳了。这跟答卷先答大题一个道理,权重高的答案放在前面,模型的注意力就往哪偏。顺序这东西不写在任何教程的显眼处,全靠自己一张一张跑对比跑出来,我把结论送你,省得你再跑一遍。

交卷前检查三处

放大到百分之两百查手、文字、透视三处,任何一处不过关都先别存图,圈出来局部重跑。这三处是AI最爱出错也最容易被你眼睛放过的地方。手我吃过最大的亏:一张自我感觉极好的图发出去,半小时后有人评论"数数她的手指",五根画成了六根,社死程度直接拉满。从那以后我养成了强迫症,存图前必放大看手指。

文字更邪门。招牌、书脊、衣服上的字母,远看人模人样,放大全是鬼画符,我的土办法是要么后期用真实字体盖掉,要么干脆让画面避开可读文字。透视的坑藏在建筑类图里,地砖的线、窗户的框,歪一点整张图就假。我给自己定的规矩是三处全过才进图库,不过的当场圈出来局部重跑,绝不存着"以后再改"——以后等于永远不会。

这套审题、答题、检查的笨流程,我用了小半年,最大的收获倒不是废图少了,是我终于能说清"我想要什么"了。AI绘画回答需求这件事,模型只负责交卷,出题的人始终是你。今晚出图前,先花三分钟把五个槽位填满再动手试试,你会回来谢那张少跑几十版的自己。

常见问题

提示词写多长算合适?

没有一个万能数字,我的参考线是五个槽位各一句、总数控制在主体之前不啰嗦。写完读一遍,凡是删掉不影响画面的词都删,长不等于准。

负向提示词要写很多吗?

不用贪多,十几条以内最好,而且要来自你自己的错题记录。抄别人的大表等于替别人考试,条条有效的那份小表,比两百条的抄来的强。

审题这么麻烦,会不会拖慢出图速度?

头一周会慢,第三周开始反而快了。我现在的对比是:不审题平均要抽六十多版才碰到能用的,审题后十版以内解决,时间省在返工上。

延伸阅读