AI绘画人物现代装怎么画?都市穿搭出图
简单说:ai绘画人物现代的关键是用写实底模、把穿搭和场景提示词写细、再配光影和材质词,出来的都市人物才不假。最容易崩的是手和服装褶皱,后期得修。
讲真,ai绘画人物现代这个方向我做了大半年,越做越发现"现代装"比古装难画多了。古装随便堆点飘逸元素就出片,现代装差一点就土、就假,像超市促销海报。今天把我画都市穿搭人物攒的经验和参数都讲透,你少踩点坑。
现代装为什么比古装难画
现代装的版型、面料、剪裁都很具体,差一点就出戏;AI模型对街头潮牌、西装褶皱这些细节训练不足,容易画成廉价风。古装靠氛围遮丑,现代装靠细节撑场,所以更难。
你想啊,古装一句话"long flowing robes, silk"就搞定了,飘逸感自带美感。现代装你写"white shirt, black suit",AI给你画出来跟房产中介制服似的。版型不对、面料发亮、领口歪——全是细节问题。
我个人觉得现代人物出片率能到三成算高手了,古装轻松六七成。所以画现代装你得做好一批跑二三十张挑一两张的准备,心态放平。
写实底模和服装LoRA怎么选
现代人物首选majicMIX realistic、Realistic Vision或ChilloutMix这类写实底模;服装细节挂服装LoRA(streetwear、business suit等),权重0.6-0.8,单挂别叠太多,否则衣服纹路会打架。
模型是地基。我用majicMIX realistic画都市人物最稳,肤色真实、衣服质感好。Realistic Vision偏干净,适合商务通勤风。ChilloutMix偏年轻潮,画街头滑板少女那种很带感。
服装LoRA我从 Civitai 找的,搜"streetwear""fashion"能挖到不少。有个坑提醒你:服装LoRA经常带着特定颜色的倾向,比如一个streetwear LoRA默认出黑色卫衣,你想画白色的就得在提示词里强调"(white hoodie:1.3)"压一压。我第一次没注意,连出十张全黑卫衣,气得我重抽半天。
找模型和在线工具不太熟的话,先翻翻 AI绘画网站清单,本地和云端都列了,选个顺手的开始。
穿搭提示词要具体到面料
别只写"streetwear"这种宽泛词,要拆到单品+面料+版型:oversized denim jacket, cotton white tee, slim black jeans, white sneakers,越具体AI越不会跑偏。
这是我反复试出来的。同样画一个都市女孩,写"casual clothes"出来的穿搭乱七八糟,写"oversized beige cardigan, white crop top, high-waisted blue jeans, canvas sneakers"立马有型有款,像穿搭博主。
面料词特别重要,因为AI靠它判断质感。cotton(棉)、denim(牛仔)、silk(丝)、leather(皮)、knit(针织)这几个最常用。我做过对比,写"cotton shirt"和"shiny polyester shirt",出来的光泽完全不同,棉的哑光、涤纶的塑料感。想画高级感就多写natural fabric、matte finish这类。
鞋子和包经常被AI画崩,提示词里单独强调"sneakers, detailed shoes"能好点。手上拿的包写"holding a leather handbag"明确动作,不然AI要么不画包要么画个四不像。
场景和光影是都市感的灵魂
都市感靠场景+光影,场景写city street、cafe、subway station,光影写cinematic lighting、golden hour、neon lights,这两组词决定整张图的氛围基调。
穿搭再好,背景是白墙也出不了都市感。我固定会写场景,比如"walking on city street, blurred pedestrians, evening, neon signs"。虚化的行人和霓虹灯一加,立马有电影感。
光影我分场景用:傍晚街头用golden hour配rim light(轮廓光),暖橙色调特别出片;夜景用neon lights配bokeh(光斑虚化),赛博朋克味儿;室内咖啡店用soft window light,文艺清新。这三套光影公式我反复用,命中率很高。
有个我个人发现的小技巧:写"shot on Fujifilm, film grain"这种胶片模拟词,出来的图会有种复古胶片质感,比数码直出耐看。现在社交平台挺吃这种调调的。
手和服装褶皱——最容易崩的地方
现代人物两只手基本必崩,用ADetailer后期修手,检测模型选手部、重绘强度0.4-0.5;服装褶皱崩了用图生图局部重绘,蒙版圈住褶皱区域重画,比整体重抽省种子。
说实话,手是AI画现代人物的死穴。插兜的手、拿咖啡的手、交叉在胸前的手,十个崩九个。我现在的流程是先正常出图,崩手不管,跑完一批挑脸和穿搭好的,再用ADetailer统一修手。
ADetailer修手我参数这么设:检测模型选hand,重绘强度0.45,步数和CFG跟主图一致。强度太低修不动,太高会把手画成新的怪物。0.4-0.5这个区间我试了几十次最稳。修完大概能救回七成的手。
服装褶皱崩的情况比手少,但西装和风衣这种硬挺面料容易画成塑料布。碰到这种情况我用图生图局部重绘,把蒙版圈在褶皱区域,提示词加"natural fabric folds, realistic wrinkles",重绘强度0.5,局部重画不动其他部分。比整张重抽高效多了。
怎么判断手和细节崩没崩,可以对照 AI绘画小白入门 里提到的几个检查点,逆向用来挑自己的图。
我的一组对比实验:三种出图参数
同样是都市女孩提示词,DPM++ 2M Karras 30步CFG6.5出图质感最好但慢28秒;Euler a 20步CFG7最快15秒但细节弱;Euler a 35步和30步几乎没区别,纯属浪费。日常我用Euler a 25步CFG7做平衡。
这个对比我是认真跑的,固定提示词和种子,只改采样器和步数,各出五张对比。结论很明确:
DPM++ 2M Karras 30步:衣服纹理、皮肤毛孔、发丝都最细腻,28秒一张。发社交媒体放大看用这个。
Euler a 20步:出图最快15秒,但衣服有点糊、皮肤偏平。批量试稿用这个,快。
Euler a 35步:和30步几乎看不出差别,26秒,纯浪费电。所以我日常锁Euler a 25步CFG7,18秒一张,质量和速度的甜点位。
这里引个数据支撑下选模型的思路。根据 Stability AI 的SDXL技术报告,新模型在服装细节和手部结构上比SD1.5有提升,但写实人物题材社区微调的1.5系模型依然更吃香——因为训练数据里真实人像占比高。所以画现代人物,老牌写实底模调好了不输新模型。
现代人物的构图和镜头
都市人物常用half body或cowboy shot(七分身)构图,镜头写from above(俯拍)或from side(侧拍),避免死板的正面证件照感,动态姿势比站立出片。
构图决定照片感。正面站立像证件照,没生气。我喜欢写"walking, looking away, candid shot"这种抓拍感,人物有动态,画面就活了。俯拍显腿长,侧拍显轮廓,这两个角度都市感强。
镜头词也写上:50mm lens、shallow depth of field(浅景深)。50mm是人像黄金焦段,出来的透视自然;浅景深虚化背景,主体突出。这两个词加上,整张图的"摄影感"就出来了,不像AI画的扁平感。
这跟 王者荣耀AI绘画可爱 那篇强调的大眼睛简背景逻辑其实相通——构图和镜头语言到位,小尺寸和放大都耐看。
常见问题
画出来的现代人物穿搭总是很土怎么办?
两个办法:一是提示词写具体单品和面料,别用casual clothes这种宽泛词;二是挂个穿搭LoRA参考真实时尚图。我以前也老出土味穿搭,把提示词写细之后好太多。
现代人物的脸不像亚洲人怎么办?
提示词加asian、korean、east asian这类,或者挂个亚洲面孔LoRA。底模也有影响,majicMIX对亚洲面孔处理比较好。还不行就上ADetailer换脸。
能不能参考某张穿搭照生成同款?
可以,用图生图或ControlNet的IP-Adapter,导入穿搭照做参考。但注意版权,自己穿的衣服拍的照片没问题,拿网图商用就有风险了。
现代人物出图要多久?
我RTX 3060,Euler a 25步CFG7约18秒一张,DPM++ 2M Karras 30步约28秒。加上ADetailer修手每张多10秒左右。一批跑20张挑两三张能用,整个流程十来分钟。
觉得有用的话分享给朋友吧。