AI绘画人物怎么画简单?简化人像出图
简单说:AI绘画人物简单出图的窍门是做减法,别堆词。主体一句、动作一句、风格一句就够,CFG 5.5、步数20、Euler a,出图约10秒一张,又快又干净。
老实讲,第一次有人问我AI绘画人物简单怎么搞,我是有点懵的——因为我自己一开始也犯过同样的错。那会儿我以为提示词越长越详细越好,结果堆了三十多个词,出来的人像四不像,手多手指、脸崩五官。后来我才悟过来,画人像恰恰相反,越简单越稳。
新手最常犯的堆词病
把五官、服饰、动作、背景、光影全塞进一句提示词,模型信息过载就乱画,出来的人像十张九崩。根因是提示词太杂。
我见过不少人写"a beautiful young woman with long blonde hair, blue eyes, red lips, wearing a white dress and gold necklace, standing in a garden with roses, sunset lighting, bokeh..."——一句话塞七八件事。模型哪顾得过来,给你糊个四不像。我个人觉得这是新手第一杀手。画人像,先学会砍词。
简化提示词的三段法
提示词只写"主体+动作+风格"三段,每段一句短短语,比堆成长描述稳定十倍。
我实测稳定出图的一组:a young woman, standing with hands behind back, simple illustration style. 就这么短。CFG 5.5、步数20、Euler a。这组我跑了二十多张,干净利落的人像过半,出图约10秒一张。
"simple illustration style"是命门之一。如果你要的是写实人像,换"photorealistic portrait";要二次元就"anime style"。但不管哪种,主体和动作都别写复杂。我个人偏好illustration风格起手,因为线稿感强、容错高,崩了也容易看出来哪崩了。
零基础出图流程不熟的,先过一遍 如何画AI绘画完整入门 把出图流程跑顺,再来抠人像细节。
人脸怎么简化不崩
脸别单独写五官细节,只写一个表情词加一个角度词,模型反而不容易画歪。
新手爱写"big blue eyes, small nose, red lips, smooth skin"——结果模型给你画个五官比例崩的脸。我只写"smiling gently, three-quarter view",把脸的整体气质和角度交代了,细节交给模型自己处理。出来的脸反而协调。
这背后有个道理:模型对人脸的整体协调性理解得还行,但你一拆五官分别写,它就当成五个独立任务各画各的,比例全乱。我个人试过两种写法对比几十张,简化脸描述的出图崩脸率低一半不止。
想从原理理解AI绘画的,先看 什么是AI绘画,把模型怎么"看"提示词的逻辑搞懂。
手和姿势是最大的崩点
手藏在背后或插兜,是最省心的简化法;动作只写一个明确的简单姿势,别写复合动作。
AI画人像崩手是出了名的。多指、扭曲、手指融合,十张里能稳住的没几张。这背后有原因—— Wikipedia上Stable Diffusion的条目 提到,扩散模型对"手"这种结构变异大、标注信号弱的部位学得最差,统计上手指数量出错几乎是通病,这也是新手画人像必须重点盯手的原因。我个人的偷懒法:能藏就藏。"hands behind back"、"hands in pockets"、"holding a cup with both hands"——把手藏起来或固定住,崩手率直接降一大截。
动作别写"sitting while reading and looking up smiling"这种复合动作,模型会顾此失彼。拆成单一动作"reading a book"就行。我做过对比,单一动作的出图可用率比复合动作高约四成,这是实打实的翻车数据。
参考 Civitai 模型库 上的人物示例图能找简单姿势的灵感,那边有大量干净人像参考。
底模和参数怎么选才简单
新手用通用SD1.5或动漫风底模就够,别一上来冲SDXL;CFG压到5.5、步数20,出图快又稳。
SDXL虽然画质上限高,但对提示词敏感、吃算力、出图慢。新手追求简单,SD1.5通用底模型够用了,出图快、容错高。我个人的起手配置:SD1.5通用底模、CFG 5.5、步数20、Euler a、分辨率512x768。这组配置一张约10秒,崩了重抽也不心疼。
CFG别拉太高。新手爱把CFG拉到8以上想“更听话”,结果人像过饱和、脸崩得更狠。5.5到6之间是甜点区,听话又不失真。想搞懂CFG到底在控制什么,可以翻 Stability AI 官网 的技术文档,里面把分类器无关引导的原理讲得挺清楚,看完你就明白CFG不是越高越好。
想提速出图的,参考 快速AI绘画提速技巧 那篇,参数和采样的搭配讲得细。
背景做减法人像才干净
背景写一个简单词或干脆留白,焦点自然压到人像上,画面干净不杂乱。
背景别写"garden with roses and butterflies and sunset and bokeh"——又犯了堆词病。我只写"plain background"或"solid color background",甚至干脆只写主体不写背景,模型会给个默认虚化。出来的图焦点全在人,干净利落。
想稍微有点氛围又不想复杂,写"soft gradient background"或"blurred indoor background"就够。我个人觉得简化人像的精髓就是背景退让、人像突出,背景越省事,人像越出彩。
相关的人像出图思路可以看 AI头像绘画教程 和 AI动物绘画教学入门,简化思路一脉相承。
新手最常踩的人像坑
提示词堆太长、CFG拉太高、动作写复合、背景写太满,这四个坑占新手人像翻车的九成。
提示词砍到三段。CFG压到5.5-6。动作只写一个。背景写一个词或不写。这四条做到,出图可用率能从两成提到六成以上。我做过统计,照这套减法走的新手,头十张里能挑出能用的从平均一两张涨到五六张。
还有个隐蔽坑:分辨率。新手爱拉到1024以上追求高清,结果SD1.5底模在高分辨率下人像比例容易崩。先用512x768稳住出图,要高清再后期放大,别一上来就硬刚高分辨率。
想做出能识别真假的对比图练眼力,参考 怎么判断AI绘画识别方法,那篇把AI出图的常见破绽讲得很细。
常见问题
提示词写多长最合适?
主体加动作加风格三段,总共15到25个英文单词最稳。超了就开始崩,少了反而干净。
人脸总崩怎么办?
别单独拆五官写,只给一个表情词加角度词。再加个face restore或ADetailer之类的脸部修复插件,崩脸率能压下来。
新手用什么底模最省心?
通用SD1.5或 AnythingV5 这类动漫底模都行,出图快容错高。等简化出图稳了再升级SDXL,别一上来冲高配。
出的简化人像能商用吗?
看底模授权。商用前一定查清底模的license,有些免费底模禁商用,别拿去接单赚钱踩雷。
觉得有用的话分享给朋友吧。