AI定向修图指哪打哪:框选、指令和兜底
先亮结论:定向修图的成败,八成在框选前的观察,两成才轮到指令。框对了,指令朴素点都能成;框错了,指令写得再花也是白搭。
AI定向修图最值钱的能力,是只动该动的地方,其余像素一个不碰。但真拿它干活的人都知道,这四个字里藏着三道坑:框怎么选、话怎么说、改坏了怎么兜底。我上个月给一家咖啡馆改菜单图里的杯子,三版才过,三版暴露的正好是这三道坑,这篇就把它们拆开讲。
先交代背景:那组菜单图一共八张,要改的是其中三张里的杯子颜色和一张里的桌面材质,客户给的期限是两天。时间不算紧,但杯子在每张图里的角度都不同,正好把定向修图的三道坑全踩了一遍。
心态也先摆正:定向修图不是一次成功的运气活,是三次重抽两次微调的常规活,期待值摆对了,操作才不变形。
框选的三个讲究,坑全在细节里
框要留过渡带、避开对称物、把倒影影子一起框进去,三条缺一条,重绘就露馅。
第一条,框比目标大一圈:只框杯子本体,AI在框边缘生硬衔接,我留出杯身外一圈背景当过渡带,融合度高出一个档次。第二条,对称物别只改一半:画面里两只一样的杯子,框一只改颜色另一只原样——观者未必说得出哪里怪,但就是怪,说不出来的怪最致命。第三条最阴:倒影和影子。我第一版把白色马克杯改成墨绿,杯子本身改得天衣无缝,桌面倒影还是白的,客户一眼指出「杯子浮起来了」。从那以后,框选前我先绕着主体找一圈它的物理附属物:影子、倒影、反光、压在它下面的布纹。
框选工具的精度反而不是重点,我用手不过关的那种粗框,配合过渡带,效果照样稳。手艺在眼里,不在框上。
过渡带留多宽有参考:物体周长的十分之一左右,小物件留几毫米宽就够,大件按比例放大。过渡带太宽会把周围无关像素卷进重绘,太窄等于没留,我拿那只杯子试了一晚上,十分之一这个数最好用。框选的形状也有讲究:矩形框遇到斜向物体,四角会压到背景,我用套索沿着物体走向圈,多花十秒,省掉的是角部的补修。
还有一类隐形的对称:文字和图案。包装上的字改了颜色,倒影里的字没改;招牌换了字体,玻璃反光里的还是旧的。字是定向修图里最容易被漏掉的对称物,我现在的检查顺序里,文字排第二位,仅次于影子。
指令写法和三次重抽的兜底
指令写「改什么+保持什么」,一次只改一个属性,重抽固定三次选最优,别在一棵树上吊死。
| 糟糕指令 | 有效指令 |
|---|---|
| 把杯子弄好看点 | 把马克杯改成墨绿色,保持陶瓷质感、手柄角度和桌面倒影方向不变 |
| 去掉背景里的人 | 移除左侧路人,把该区域补成货架延续的样子,保持透视和噪点一致 |
「改什么」人人都记得写,「保持什么」才是成败手——AI不知道哪些是你认为不能动的,你不说,它就按它的审美来。重抽三次是我的固定动作:同一指令跑三次,结果差异可能很大,挑最接近的一次再微调,比在第一版上反复补救省时间。三次都不行,别恋战,回去改框或者拆步骤——把「换颜色」拆成「先重绘物体、再统一倒影」两步,成功率立刻不一样。
指令语言也有讲究:中文描述属性时把形容词放在名词前,量词给足,「墨绿色的陶瓷马克杯」就比「杯子改成墨绿那种感觉」成功率高得多,AI不吃「感觉」这一套。重抽的间隔也有讲究:连跑三次不如每次跑完先干点别的再回来,隔几分钟再看,好坏立判。盯着看的时候,人眼会替AI找补,放一放,破绽自己浮出来。
拆步骤不丢人。我拆过最狠的一次,一个换色需求拆成四步:重绘物体、修倒影、修影子、统一色温,每步出一张检查图。看着笨,比三次豪赌全错便宜得多。
指令的语法系统讲法,之前写过一篇局部重绘怎么用?指令写得越死,重绘越听话,跟这篇配套着看正好。
咖啡馆那单最终三版定稿,第三版过的时候,客户在电话里说了句「跟实拍换的一样」。AI定向修图的尽头不是技术,是观察习惯:动框之前,先把主体周围的光影、对称、附属物看全。眼睛先到位,手才准,顺序反了就全靠运气。那家咖啡馆后来把菜单图全年的更新都给了我,理由是「你改图我心里有底」。底气比手艺值钱。
常见问题
框选区域最大能到多大?
经验上超过画面三分之一就该考虑整体重做了。大区域定向重绘的一致性很难维持,成本不如局部加整体调色。
改完的颜色和原图色温不搭怎么办?
重绘区域单独做一次色温和饱和匹配,再全局统一看一眼,两步下来基本能抹平差异,别上来就全局动。
一张图能做几处定向修改?
我的安全线是三处以内。每改一处都可能破坏整体关系,超过三处建议分层处理,每层出片检查一次。
定向修图和手动修哪个快?
小改动手动快,中等复杂度AI快。我的分界线在「要不要重建光影关系」,要重建的交给AI,纯色彩的手动更快。
重绘区域清晰度和周围不一致怎么救?
对重绘区做一次轻度锐化或补同量级噪点,把质感粒度对齐。缩略图下过关、放大后连续,就算合格。