AI 绘画 中文提示词到底行不行:和英文逐句对比的实测
别绕了:AI 绘画 中文提示词日常完全能用,名词类的画面跟英文基本打平;可风格词和细腻形容词一上场,英文还是稳赢。我的做法是主体用中文、风格用英文,混着写,省事。
我在绘画群里因为坚持写中文提示词,被人嘲过「不专业」。气不过,我干脆做了个实验:挑三句最常用的画面描述,用 AI 绘画 中文版和英文版各跑十张,跨两家工具,拢共六十张样图摆在一起看。结果挺出乎意料,大部分场景两边真没什么差距,真正的分水岭藏在两种词里。实验设计得挺笨但管用:锁同一批种子,中英两边只动语言不动内容,谁出偏了一眼就能看出来。先把数据放这儿,结论咱们慢慢说。
同一句话中英各跑十张:多数打平,两处例外
名词类提示词中英出图率基本打平,差距集中在风格词和细腻形容词上,一个英文占优,一个中文占优。
三句测试提示词,第一句「玻璃瓶里的干花,窗边逆光」,中英各跑十张,能用的都是五六张,分辨率、构图、光影没看出稳定差异。第二句「雨后巷子里的自行车」,也是平手。说实话,日常拍脑袋想画的画面,中文提示词一点不吃亏,国内工具对中文的理解比两年前好太多了,这个印象里的「英文更强」其实早就过时了一半。顺带一提,静态静物类画面是中英文差距最小的品类,你手里如果是人物和场景大图,结论要重新算。
例外出现在第三句,我加了风格词「吉卜力风格的水彩质感」。中文写「吉卜力风」,出来的图有的往「童话城堡」跑,跑偏得莫名其妙;换成「Ghibli style watercolor」,十张里七张方向是对的。反过来,像「斑驳」「温润」「氤氲」这类四字词、文言味的形容词,中文反而是赢家,英文翻译过去就只剩个模糊的对应词,味道全丢了。所以别一刀切,得看词的类型。
什么时候必须换英文:风格名、镜头术语、社区黑话
风格名、摄影镜头术语、模型社区的黑话这三类,优先写英文,中文直译经常被理解成完全别的东西。
我的经验分三档。风格名必换英文:Ghibli、cyberpunk、art nouveau,这类词的训练数据标签大多是英文,你写中文等于让模型自己猜翻译。镜头术语分工具:国内工具写「浅景深」「虚化」好使,写 bokeh 反而画蛇添足;国外模型倒过来,得写 depth of field。社区黑话只能英文:cel shading、lineart 这类,中文几乎没有对应说法,硬翻必翻车。判断标准其实不复杂:一个词在英文社区里是行话,就老老实实写英文;一个词在中文里自带画面,就别瞎折腾成英文。
我翻过一次很典型的车:想画「赛博朋克夜景」,偷懒写了中文,出来的图是个霓虹灯牌集合,朋克没了,只剩赛博。老老实实换回 cyberpunk city at night,楼层高度、雨面反光全回来了。你现在就可以检查一下自己的提示词收藏,凡是风格类的词,多半都该换成英文,这一条改动就能救回不少图。
中英混写是我现在的那个默认做法
默认写法:主体和场景用中文打底,风格与镜头词用英文缀在后面,各交给最擅长的语言,出图最省事。
给个能直接抄的模板:「黄昏的菜市场,摊主在收摊,暖色灯光 / documentary photography, 35mm, soft light」。斜杠前面中文管内容,后面英文管手法,两边不打架。我用这个结构跑了一个月,废片率比我全中文时期降了三成左右,比我全英文时期顺手得多,起码不用一边写一边查单词。
有个前提要交代:少数工具不支持混写,会把英文部分直接无视。判断办法也简单,把英文部分单独删掉跑一遍,画面一点不变,说明它根本没读进去,这种工具你就老老实实单语写。我手上两家主力工具,一家吃混写吃得很好,一家完全不认,这个差异工具文档里都不会写,只能自己试。另外混写别太碎,别一句里中英交替夹着来,模型容易串味,按「中文块加英文块」这种整段分最稳。
实验做完,群里嘲我的那位也跑了一遍我的对照样图,现在我俩的提示词长得一模一样,全是混写。语言不是立场,是工具,哪边好使用哪边。你今天就可以动手:把你最常用的一句提示词,中英各跑十张,十五分钟就能知道你的工具吃哪套,比看任何攻略都准。
常见问题
用翻译软件把中文直译成英文行不行?
能用,但不是最优解。直译会丢掉语义密度,「斑驳」翻过去就剩 mottled 一个词,味道全没了。我的习惯是英文写完再回译成中文检查一遍,回译都对不上号的,多半翻得不准,改词重翻。
中文成语和诗句提示词好用吗?
分工具。国内工具对「孤舟蓑笠翁」这类描述理解得意外地好,画面意境能出来;国外模型容易理解成字面元素堆砌,比如真给你画一叶舟一个老头,意境全无。诗意描述走中文,走国内工具。
工具官方说支持中文,为什么还会翻车?
支持和理解是两回事。很多模型的底层训练标签是英文,中文进来先做一道翻译,翻译这步就会丢信息,风格名、黑话丢得最狠。官方说的支持,指的是能出图,不保证跟英文一个理解精度。