AI修图描述怎么写才听懂?喂了一年提示词的经验帖
会说话就会修图?恰恰相反。AI修图描述吃的是具体:位置给九宫格方位,光线给方向和软硬,要保留的东西逐条点名。先把手里的模糊词全部换成可执行指令,比换十个工具都管用。
AI修图描述不是「会打字就行」,这是我喂了一年提示词换来的结论。去年9月刚上手时,我把AI当成一个会读心术的美工,扔一句「把照片弄好看点」就坐等出图。结果它把我跟朋友的合影调成影楼风,皮肤磨得连毛孔都不剩,朋友看完发来三个问号。从那天起我开始记笔记:它听得懂的不是「好看」,是坐标、数字和清单。
位置描述:别用手指方向,给AI一个坐标系
位置描述要给九宫格方位或参照物,例如画面右上角、人物左后方,别写「那边」「这里」。AI没有手指,你指得越准,它下手越稳。
翻车现场我记得很清楚。去年10月一张在成都春熙路拍的街拍,背景有个路人入镜,我写的是「把后面那个人去掉」。跑出来的图,路人稳稳站在原地,我朋友肩上的包带没了。改到第3次我才写对:移除画面右上角穿白色卫衣的路人,其余人物、店铺招牌和地面反光全部保留,一次过。
从那以后,我所有位置描述都套一个格式:九宫格方位加参照物。左上角、正中偏右、人物左后方、杯子旁边。像给快递员填地址,写到门牌号才送得到,写「大概那个小区」就只能等退件。
这个手感是练出来的。我拿库存照片每天改3张,每张只动位置相关的需求,两周下来大概40多张,一次过率从三成提到七成。方法笨,但账算得过来,比反复重跑省时间。
同一需求三种说法,效果能差出一截
同一个修图需求,模糊说法和精确说法的可用率能差一倍以上:把幅度、方向、保留项全部写死,AI一次出图的概率明显更高。
今年5月我用同一张逆光人像做了个笨实验。需求就一个:让照片亮一点、暖一点。三种说法各跑5次,结果记在备忘录里。第一种「调亮调暖,好看点」,5次里2次能用,脸部高光经常溢出成一片白;第二种「亮度+10%,色温偏暖」,基本能用但皮肤发橙,得再手动补一轮;第三种写了60多个字:保留原图对比度和人物肤色,将阴影提亮15%,高光降低5%,整体色温向暖偏移,背景天空细节保留。5次里4次直接可用。
第三种胜出的原因说白了就一条:它把「多少」说死了。就像跟理发师说「剪短点」和说「两边推3毫米、顶部打薄一半」的区别,后者不用碰运气。这套判断跟GPT AI修图听懂人话吗里的结论一致,模型对模糊词的容忍度比大多数人想象的低得多。
我到8月底已经在备忘录里记了200多条这种对照,每条后面标「可用」「要补」「废」。回头看废掉的那批,八成栽在同一个坑:给了形容词,没给刻度。氛围感、高级感、干净一点,这些词AI接不住,它不知道往哪个旋钮上拧。
光线和「保留什么」,决定AI敢不敢乱动
光线要给方向和软硬,例如左侧窗光、柔和逆光;改完必须点名保留项,例如面部纹理、瓶身文字。不圈范围,AI就自由发挥。
今年6月帮朋友修一张香水瓶产品照,我顺手写了句「加点氛围感」。出来的图多了几个光斑,挺好看,可瓶子上的英文标签被改成了乱码,我盯着那张图愣了半分钟。那天的教训换来一个万能句式,现在每条描述结尾都挂着保留清单:改什么、怎么改、保留什么,三段各占一行。瓶身文字和logo不动、背景桌面材质不变、只调整光源位置。
光线词汇也是这一年攒的。顶光显秃,45度侧光最稳,轮廓光适合深色背景,柔光比硬光容错高。说实话这些词我以前一个都不会用,全是一次次翻车喂出来的,谁教都没用。
话说回来,也不是每张图都要写这么细。随手发朋友圈的照片,一句「亮度+8%,别动脸」就够,写太细反而慢。正经要发的东西,比如给客户看的图、要打印的照片,才值得把三段式写满。手机App里的「消除笔」也是同一个逻辑:涂抹前先想清楚要圈多大范围,我一般只框住目标再加一圈边,框太大,周围的纹理会被重画。粗细自己权衡,别拿同一套模板硬套所有图。
回到开头那句「会打字就行」。一年下来我的体会是:会说话,说的是把话拆成坐标、刻度和清单,工具每个月都在换,这套表达方式到8月底我还在天天用。你下次修图前,先试着把「好看点」翻译成三行指令,差距立刻看得见。
常见问题
AI修图描述写多长合适?
单条40到80字最稳,超过150字多个指令容易互相打架,AI会漏执行。我的习惯是一条描述只管一个修改目标,复杂需求拆成两轮跑,第一轮定大方向,第二轮抠细节。
AI修图描述可以用英文写吗?
可以。我今年7月把同一组描述用中英文各跑过5次,部分海外模型对英文方向词响应更准,但涉及保留照片里的中文文字时,中文描述出错更少。混着用最省事:结构指令用英文,保留项用中文。
照搬别人的提示词模板为什么没效果?
模板里的位置、光线、参照物是绑定对方那张照片的,换一张图就全对不上。能借的只有句式:改什么加怎么改加保留什么。具体数值要按自己的照片重新填,这一步没有捷径。
一条描述里能同时改几处吗?
最多两处,而且最好挨得近。我踩过的坑是一句话里又要删路人又要换天空,结果路人留着,天空换了两次。同时改两个方向,AI经常只执行一个,拆开写反而更快。