AI短片绘画实测:分镜和首帧怎么画?风格统一与镜头语言的记录

AI短片绘画实测:分镜和首帧怎么画?风格统一与镜头语言的记录
AI短片绘画实测:分镜首帧与镜头语言的出图记录

别绕了:短片题材的图单独看都不差,连起来播就露馅。要害就两条,全片锁一套视觉模板,每张图提前想好景别,我按一支三分半短片的实际流程讲。

接了个小活,给朋友的咖啡馆做一支三分半的短片,讲一个女孩从推门到打烊的一天。我天真地以为AI短片绘画就是把单张图画好,结果第一版分镜发过去,朋友回了句:这怎么一会儿油画一会儿赛博,女主换了两张脸?那一刻我才明白,短片拼的不是单张质量,是一群图像一支队伍。两百多张图跑下来,我把两个环节的坑都踩了一遍。

分镜图和首帧图,是两种活

分镜图求快求准,构图对了就行;首帧图求精求稳,是给视频工具打底的成品质图。别拿同一套精度做两种图,分镜粗糙点反而效率高。

分镜阶段我用最低成本出图:分辨率压低,采样步数砍半,一张图几秒钟出完,不求细节只求构图和人物位置。一场戏我通常出四到六张摆在一起挑,像拼条漫一样排成一排看节奏。这个阶段卡得越糙越好,卡太细纯属浪费,反正后面每张都要重做。

分镜真正要盯的是三样东西:人物在哪、光从哪来、画面重心高还是低。我会在每张分镜旁边用一句白话备注这场戏干嘛,比如「女主犹豫要不要进去,光在她脸上闪了一下」。别小看这句备注,等到精修首帧的时候,它就是现成的提示词素材,比凭记忆回忆强得多。

首帧图就完全两回事了,它是喂给图生视频工具的底图,视频的运动、光效全从这张图长出来。我的习惯是十六比九,主体放在画面中间偏左或者偏右三分之一的位置,四周留出呼吸空间,视频工具动起来才不容易裁到人物。有一条血泪教训:首帧图里人物动作别画太满,我画过一张女主双手举过头顶欢呼的首帧,视频生成时胳膊直接拧成了麻花。动作幅度留三分,留给视频工具去补。

风格统一:光锁提示词不够

风格统一不能只靠复制提示词,要把描述模板、光线方向、主色板三样东西一起锁死。尤其主色板,每场戏定一个主色,写进该场每张图的提示词里。

第一版跑偏之后我复盘,发现换了场景的戏全在漏风:室内暖橙、室外冷蓝,倒不是不行,坏在连画风都跟着变,室内是厚涂,室外成了水彩。光锁提示词没用,因为提示词是我凭感觉现写的,每一版都有微调。

解法是把提示词做成模板。开头固定一段不动的风格锚点,画风、镜头质感、光线方向写死,后面只替换主体和场景词。我给这支短片定的锚点大约四十个字,二十七个镜头一字没改过。主色板是误打误撞发现的:清晨那场戏我全组图都塞了「薄荷绿的晨光」,成片剪出来那一段色调齐得像一个人画的,后来干脆每场戏都先定主色。另外种子也别乱换,同场戏尽量同种子微调,脸的稳定性会好不少。

说到底,单张出图可以每张换个画风图新鲜,短片不行,观众前三十秒建立起来的视觉预期,第四十秒就被你亲手砸了。风格统一这件事在短片里不是加分项,是及格线。

镜头语言:让图先有导演意识

每张首帧图动笔前先答两个问题:这个镜头什么景别,观众此刻该看哪里。景别词和视线引导写进提示词,图才有叙事的节奏感。

我做过一组对比,同一间咖啡馆的九个镜头,一版随手出图,一版按景别规划来:推门用低角度中景,女主犹豫用面部特写,打烊用大远景。剪在一起高下立判,规划版看着像有人拿着分镜本拍的,随手版像九张明信片。差别就在景别词,远景、中景、特写、俯拍、仰拍,这些词得真的用起来,不能全场都是中景站桩。

视线引导也有讲究。想让观众看女主的表情,就把她放在光最亮的地方,背景压暗一点;想让观众注意窗外的雨,就给窗户单独打一层反光。AI不会替你做导演,但提示词里写了,它就照办。三分半的短片,我最后按每三到四秒一个镜头排,一共二十七个镜头,比原计划的四十个砍掉三分之一,节奏反而顺了。

短片交付那天,朋友在店里循环放了三遍,说比他预期的像样多了,还要请我喝一个月咖啡抵账。回头看,这支片子救了我自己的,恰恰是最开始那次翻车:单张再漂亮,服务不了叙事就是废图。你下次做短片绘画,先把风格锚点和主色板钉死,再画分镜,最后精修首帧,顺序对了,两百张的弯路你一步都不用走。

常见问题

分镜图用什么画幅比例合适?

短片正片一般十六比九,分镜就照这个比例画,构图和成片才能对上。如果成片要发竖屏平台,分镜阶段就该换成九比十六,中途换比例等于构图重做。

首帧图之外还要画尾帧图吗?

转场多、运镜长的镜头建议画,首尾帧一起喂给视频工具,中间的过渡稳很多。普通短镜头单首帧就够,尾帧留到剪辑时看情况补。

人物在不同镜头里脸总是变,怎么办?

同场戏锁同一个种子,提示词里人物外貌的描述一字不改,再垫一张定稿的角色参考图控制脸部。跨场戏波动大一点正常,剪辑时靠镜头切换能盖掉大部分。

延伸阅读