国产ai绘画关键词怎么写才听话?中文提示词实战心得

国产ai绘画关键词怎么写才听话?中文提示词实战心得
国产ai绘画关键词中文提示词组织方式示意图

直接给结果:国产模型写关键词,动词和位置词的权重比形容词高。把"站在哪、做什么、镜头朝哪"交代清楚,比堆一串"绝美、震撼、高级感"管用得多,出图也稳得多。

国产ai绘画关键词怎么写,网上吵了很久。有人坚持"英文咒语天下第一",有人号称中文随便写都行,两头都太绝对。我2026年上半年基本把主力挪到了国产模型上,几个月用下来一个核心感受:中文提示词不是不能打,是得按中文的说话习惯来组织。硬把英文咒语那套搬过来,水土不服是常态。下面分三块讲我的写法。

三个主心骨:主体、动作、视角

中文提示词先定三件事——画面主体是什么、正在做什么、镜头从哪个角度看。这三件定了,形容词才有地方挂,缺一件图就发飘。

我拿自己的一段常用写法举例:"傍晚的天台,穿米色风衣的女生背对镜头眺望城市,中景,右侧留白"。主体是女生,动作是眺望,视角是中景背拍,三件事两行写完,出图命中率比当年堆二十个形容词高了一截。2026年2月我专门对比过:同题材下,三主心骨写法跑二十张能挑出七八张可用,形容词堆砌的写法二十张里挑两张,差距就是这么直白。

中文的好处是语序天然带着逻辑,"谁在哪干什么"顺着写就行。你用写散文的思路写提示词,模型反而容易懵;用交代事情的思路写,它立刻精神了。

从英文切回中文的头两周其实挺别扭。我手头的英文词库攒了一年,换中文等于重新摸一遍各词的深浅。过渡期我的笨办法是中英对照着写:同一条咒语两个版本各跑五张,看哪边的词在国产模型里真正起了作用。两周下来,留下的中文词不超过五六十个,但个个都验证过,比抄来的清单踏实。慢是慢了点,根基是真的。

哪些中文词一写就灵,哪些装没听见

具体名词和方位词模型一听就懂,比如"木窗格、逆光、左侧三分之一处";空泛的审美形容词如"高级感、氛围感"多半被忽略,写了等于没写。

我的词库里有条分界线。灵的一侧:材质词(亚麻、黄铜、磨砂玻璃)、光线词(侧逆光、烛光、阴天散射光)、构图词(俯拍、特写、留白在右)。不灵的一侧:所有"感"字辈——高级感、氛围感、故事感,还有"绝美""震撼"这类没有画面的词。它们不产生任何视觉信息,模型只能靠猜。

有个词我单独说说:"意境"。它算半灵,单写没用,但配上具体物象就活了,比如"雨后青石巷的意境",比干写"意境"强十倍。词是死的,搭配是活的,这话在中文里格外灵验。

词序也值得留意。中文语序变了,重点跟着变。"逆光下的少女"和"少女的逆光"在模型耳朵里是两句话,前者的光是被强调的主角,后者光成了配菜。我把同一组词换三种语序各跑一轮,画面的重心肉眼可见地在挪。所以写完关键词自己先读一遍,你读着重点在哪,模型就画在哪,这点上它比你想象的更"听话"。

翻译腔的坑:直译英文咒语为什么跑偏

英文咒语直译成中文,约有两三成词在国产模型里对不上号,典型如镜头参数类和社区黑话类,出图偏差大多出在这两成上。

最典型的是镜头词。英文圈那套焦段、光圈的写法,很多国产模型是当普通名词处理的,写多了反而引入奇怪的画面元素。我2026年4月把一条热门英文咒语逐词翻成中文去跑,二十张里十一张构图怪异,把镜头词删掉重跑,怪图立刻少了一半。那一晚我盯着两组图对比到半夜,算是彻底想通了:不同模型听不同的方言。

社区黑话是另一个坑。英文圈流传的一些缩写和梗词,直译过来在中文语境里毫无意义,模型要么无视要么乱画。与其硬翻,不如在国产模型的语境里找它自己的对应说法,多翻翻官方文档和社区热帖,比我这里列清单更及时。

中文提示词写到现在,我的体会可以归成一句话:把模型当成一个字面理解能力很强、但一点幽默感都没有的实习生。你说具体,它就干得像样;你说空话,它就交白卷。国产模型这几代的中文理解确实在肉眼可见地进步,写关键词的思路却一直没变过——具体、有序、别废话。哪天你发现自己写的中文提示词十出六七张能用,回头看这篇,会发现三个主心骨已经长在你手上了。

常见问题

中文关键词字数写多少合适?

我的习惯是三四十到一百字之间,三主心骨各一句。太短没有约束力,太长各层互相打架,先短后长地加,每加一段跑三张验证。

要不要在中英之间来回切换着用?

可以。我的分工是国产模型走中文,国外模型走英文,各用各的母语。混着写最容易出问题的是风格词,两边词库不通用,别偷懒直译。

国产模型画中文字效果怎么样?

短词现在基本能看,两三个字的牌匾、标语成功率已经不低。长句子还是别指望,写进提示词不如出图后自己排版压上去,省心得多。

同样的关键词不同国产模型效果差异大吗?

不小。底层训练数据不同,方言也不同。我换模型时会把老关键词先跑五张摸脾气,重点看它对动作词和方位词的反应,再决定要不要改写法。

延伸阅读