open ai修图上手记:打字改图的手感与边界
这事我上手试了一周:打字让AI改图,顺手时像有助理,拧起来能把影子方向改错。十条常用指令、三次翻车和适用边界,都在这篇。
open ai修图的玩法和传统滑杆修图完全是两路:你不去找参数,用打字描述要什么。我拿同一组产品图——六张玻璃器皿加木托盘——做了七天对照,左手滑杆右手对话框,哪边顺手、哪边翻车、各自的舒适区在哪,一周下来摸得差不多了。
先说设备:一台五年前的笔记本加普通宽带,全程没排队没限流。门槛低到几乎没有,所以更值得把规矩立好。
打字改图的指令,我沉淀了十条
最好用的指令都有一个共同点:说清改什么、留什么、别动什么。一句话只安排一个改动。
十天里高频返工后剩下的十条,挑五条举例:「背景换成哑光浅灰,保留木托盘和影子」「左上角加柔光,强度像清晨窗光」「瓶身反光减弱,但保留轮廓高光」「画面上方留白三分之一,别加任何物体」「整图色温偏暖一点,别动白色物品的颜色」。共同点已经写在上面那句里了——每条都在说「别动什么」。
指令的长短也有讲究:我试过一次写七八条要求的「全家桶」指令,AI顾此失彼,五条要求能落实三条就不错了。一次一个改动,出图十五秒,不满意改指令再来,节奏反而最快。
另外五条也交代下,都是返工换来的:「保持托盘木纹的裂纹,别顺化」「玻璃杯壁的高光留一条竖的」「整体亮度不动,只提暗部」「构图不变,把右边的杂线修掉」「输出保持原比例,别裁方」。你会发现一半都在防守。进攻的指令写一句就够,防守的得写全。
三次翻车:AI理解错在哪
三次翻车分别栽在影子方向、留白处理和图内文字上。全是它「好心」的再创作。
第一翻:我让AI「把背景换得更亮」,它把光从左边挪到了右边,托盘的影子跟着转向,跟下一张图排在一起,太阳一天里换了三个方向。第二翻:我要「画面干净点」,它把背景里那盆当道具的绿植删了,还顺手把木纹理顺了——木纹是客户选的质感。第三翻最险:图上有手写体的小标签,我让AI「清理污渍」,它把标签上的字重绘了一遍,两个字的笔画是错的,要不是放大检查,差点就交付。
三次翻车的共性:我描述的是结果,它理解成了「授权再创作」。从那以后我的指令里必带「保留」条款,涉及文字的区域一律写「不要碰」,这条纪律跟局部重绘怎么用?指令写得越死,重绘越听话里的结论一模一样,两个工具在这点上脾气相同。
翻车之外也有惊喜的一次:我说「氛围像雨后的清晨」,它给背景加了一层湿润的反光感,木托盘的颜色沉了半度,整体立刻高级。这种说不清道不明的氛围词,滑杆是调不出来的,因为没有一个滑杆叫「雨后的清晨」。这是对话式真正的长板,值得留着。
滑杆和对话,各自适合什么活
探索和改背景交给对话,精确调色和批量统一交给滑杆,混搭效率最高。别让一种工具干全活。
| 任务类型 | 更顺手的工具 | 原因 |
|---|---|---|
| 换背景、加元素 | 对话式 | 滑杆做不到 |
| 调曝光曲线 | 滑杆 | 数值要精确 |
| 试多种风格方向 | 对话式 | 改指令比重调参数快 |
| 整组色调统一 | 滑杆 | 一致性靠数值锁 |
| 局部小修改 | 对话式 | 圈选加一句话 |
我现在的工作流是先对话后滑杆:用打字快速试出方向,锁定后回到参数工具里把数值落死。对话式出来的图我会再校一遍色,它的输出偶尔带点说不清的偏色,单张看不出,一批图放一起就露馅。
时间账也记了:七天内同一组图,纯对话流程平均每张三分钟含两次重试,纯滑杆平均八分钟,混搭六分钟。到了第二组的十二张,混搭降到五分钟,纯对话还是三分钟——差别在重绘率,指令练熟以后重试少了一半。学指令花的时间,会在后面每一张图上赚回来。
七天用下来,我给open ai修图下的定语是「探索利器,交付慎用」。它把修图的门槛降到了会打字就行,代价是你得盯紧它的每一分「好心」。打字改图这个手感,试过就回不去,回不去的不是省事,是那种描述一句、画面就动一下的对话感——前提是你管得住它。
常见问题
对话式修图适合修人像吗?
改背景、换服装颜色、补光这类大方向的活适合;磨皮瘦脸不建议,它对「自然」的理解和你未必一致,人像的五官分寸还是参数工具靠得住。
指令用中文还是英文效果好?
中文描述常见需求没问题,非常具体的质感词英文命中率略高。我的土办法:中文说一遍不满意,把关键词翻成英文再试,两轮基本能到位。
改图会改变原图分辨率吗?
会,多数对话式工具输出固定在两千万像素上下,比你上传的图大或小都有可能,交付前记得按用途重采样,别直接拿输出当最终稿。
一次对话能改多少张图?
一张一张来最稳。批量场景我试过让AI「按这张的风格处理所有图」,结果每张的自由发挥程度不一样,批量还是得靠参数工具锁。
上传产品图给AI修图安全吗?
看服务条款,未发布的商品图留意两条:是否用于模型训练、保留期限多久。介意的话压低分辨率再传,或者等正式发布后只修公开图。