月鹿造物 发布 2026-09-08 21:29:10 发布于 2026-09-08 21:29:10 月鹿造物·AI时代独立创作者笔记 我用 GPT 生成了一张 12 格的黑白铅笔分镜,丢给 AI 视频工具,出来一条 15 秒的短片——角色稳定,镜头切换流畅,分镜还原度很高。 整个过程不到 20 分钟。没有一个镜头一个镜头地单独做,没有手动拼接,没有开剪映。 这篇文章里有完整的故事版制作方法、GPT-image-2 的生成提示词、还有四种不同场景的实测视频。 故事版是什么 先说清楚这个词。 故事版(Storyboard),就是拍片前画的分镜草图。传统影视里,导演和分镜师会在纸上画出每个镜头的构图、角色位置、运镜方向,整个剧组看这一张图就知道要拍什么。 用在 AI 视频里,逻辑一样——你画一张完整的分镜图,AI 看着这张图来理解"第一个镜头拍什么、第二个镜头接什么、角色长什么样"。 跟之前一个镜头一个镜头单独做的方式比,最大的区别是:一致性从"人手动管"变成了"系统自己管"。 以前每个镜头都要单独提交、单独附一张角色参考图、出来再手动拼接。故事版的做法是一张图、一次提交,整条片子一口气出。 故事版长什么样 我测下来效果最好的格式是这样的: 12 格面板,黑白铅笔草图风格,手绘线条,细节尽量少。每格画一个镜头,标注景别和动作方向。 关键是色彩标注系统——红色箭头标身体动作方向,蓝色标镜头运动,绿色标构图引导线,橙色标光源方向,紫色标情绪弧线,黑色文字写镜头备注。 听起来很专业?其实不用你画,GPT-image-2 直接生成。

第一步:角色设定 + 场景设定

先搞定角色。两种方式都行: 让 AI 生成——用 GPT-image-2 描述你想要的角色,它直接出图。我的月鹿和夜枭就是这么来的。 给参考图——你已经有角色形象了(手画的、找的、之前生成过的),直接拿来当参考图用。 不管哪种方式,角色确定之后都要出一张三视图——正面、侧面、背面。三视图是后面所有环节的"角色身份证",故事版生成和视频生成都要参考它,角色一致性从这里开始锁定。 场景也一样,两种方式: 让 AI 生成——描述你想要的场景,GPT-image-2 出一张场景设定图。我的温馨书房就是这么做的。 给参考图——你有现成的场景图、实拍照片、或者其他风格参考,直接拿来用。 场景图单独出,不要把角色画进去。目的是让 AI 知道"故事发生在什么地方"。

第二步:一句话生成 12 格分镜

提示词的核心结构: 黑白铅笔草图故事版,12 格面板,4×3 网格排列。 手绘线条风格,细节尽量少。 色彩标注系统: - 红色箭头 → 人物身体动作方向 - 蓝色箭头 → 镜头运动方向 - 绿色虚线 → 构图引导线 - 橙色 → 光源方向 - 紫色波浪线 → 情绪弧线 - 黑色文字 → 景别和动作备注 [具体的故事内容和每格镜头描述] 加上人物和角色参考图一起提交给 GPT-image-2,几十秒就出一张完整的 12 格故事版。 我用这个方法生成了四个完全不同的场景: 对话篇——月鹿和夜枭在书房里讨论 AI 做视频,从吐槽翻车到发现故事版。日常温馨的情绪线。 打斗篇——月鹿和夜枭功夫对决,飞踢、格挡、慢动作定格。快节奏的动作线。 电商篇——月鹿在直播间看到夜枭 AI 玩偶,下单、开箱、激活。带货种草的情绪线。 3A 游戏展示——这个不一样,不是 12 格故事版,是一张赛博朋克风格的角色定制界面。单图驱动视频。 四种场景,四条完全不同的叙事线,都是同一套方法。

第三步:故事版丢给 AI 视频工具

这一步很关键,有个坑要说。 故事版生成完,不能直接丢给视频工具说"按这个拍"——它会把你的 12 格面板布局也当成画面内容,出来的视频就是一张分镜表在那动。 提交的时候要明确告诉它: 不要生成分镜表格,不要保留 12 格面板布局,不要黑白铅笔草图。参考图只用于理解镜头顺序、人物动作和叙事节奏。 加上这句,AI 就知道故事版是"导演的笔记",不是"要拍的画面"。 我用的是小云雀(Pippit),它走 Seedance 2.0 模型。15 秒一段,四个场景的效果直接看: 对话篇——月鹿和夜枭在书房聊天,角色稳定,表情自然,镜头切换跟故事版的节奏基本吻合。 故事版分镜图 ↓ 生成的视频 ↓ 打斗篇——月鹿和夜枭功夫对决,动作幅度大,有几个镜头的打斗动态还挺像样。 故事版分镜图 ↓ 生成的视频 ↓ 电商篇——月鹿刷直播下单夜枭 AI 玩偶,开箱、捧起、抱在怀里,种草流程很连贯。 故事版分镜图 ↓ 生成的视频 ↓ ——这个不是故事版驱动,是单张赛博朋克角色定制界面图驱动的。换个思路,一张精细的设定图也能出动态展示视频。 角色定制界面图 ↓ 生成的视频 ↓ 15 秒是个关键数字 目前 Seedance 2.0 单次生成的上限是 15 秒。15 秒听起来短,但一张故事版 12 个镜头塞进去,节奏刚好够紧凑。 如果要做更长的剧情片,思路是拆成多段 15 秒,每段用一张故事版驱动,段与段之间靠同一套角色参考图和场景设定来保持一致性,最后拼接成完整短片。 故事版在这里的价值就体现出来了——每一段都有明确的分镜规划,角色锁定,场景锁定,拼起来不会跳。 黑白还是彩色 故事版不一定非得是黑白草图,彩色分镜也能用。两种各有适合的场景。 黑白草图——AI 从中提取的主要是结构信息:谁在哪、做什么动作、镜头怎么切。不会被颜色和风格干扰,成片的画面风格完全由 AI 自己发挥。适合你对最终画风没有强要求、想让 AI 自由发挥的情况。 彩色分镜——除了结构,还能传递色调、光影、氛围。AI 出来的成片会更接近你预想的样子,但它也会"照着画",自由发挥的空间就小了。适合你对画面风格有明确想法、想精确控制色调氛围的情况。 我这次测试用的是黑白草图,因为我更想看 AI 自己能做到什么程度。但如果你要做品牌片、想控制每个镜头的色温和光感,彩色分镜是更好的选择。 不是哪个更好,是看你要什么——想放手就给黑白,想控制就给彩色。 这套方法能干什么 回头看这四个场景,其实覆盖了很不一样的用途: 1对话/叙事 ——品牌故事、产品介绍、IP 动画短片 2动作/打斗 ——游戏宣传、动作预告 3电商/带货 ——产品种草、开箱展示 4游戏 UI/角色展示 ——3A 游戏预告、角色展示 同一个 IP(月鹿和夜枭),换一张故事版,就是一条完全不同的片子。角色锁定,场景随便换。 以前做这种事情,要么找动画团队报价,要么自己在剪映里慢慢拼。现在的流程是:写故事大纲 → GPT 画分镜 → 丢给视频工具 → 出片。 20 分钟,一条 15 秒短片。 提示词(直接能用的) 下面是我实际用的提示词,不是模板,是真跑出结果的。你复制过去把角色和场景换成你自己的就行。 用到的工具: 生图:GPT-image-2 生视频:小云雀(Pippit),Seedance 2.0 模型,15 秒,9:16 竖屏 ①角色三视图(我实际用的) 角色设定图,三视图(正面、侧面、背面),纯白背景。 角色名称:月鹿 外观描述:奶茶棕短绒毛小鹿,脸部和腹部米白绒毛, 头顶一对金色鹿角,深棕色大圆眼,粉色小鼻子和腮红, 围米白针织围巾配金色月牙吊坠,四肢末端深棕色, 圆润短壮体型。 风格:3D 毛绒玩偶质感,圆润造型,柔和光影。 要求:三个角度的外观保持完全一致,配色、配饰、比例不变。 换成你自己的角色时,重点写清楚:体型、颜色、五官特征、标志性配饰。配饰很重要——眼镜、围巾、吊坠这些是 AI 后面识别角色的锚点。 ②场景设定图(我实际用的) 场景设定图,温馨书房。 木质书桌靠窗摆放,桌上有笔记本电脑、台灯、咖啡杯, 书桌后面是满满的木质书架,暖黄色台灯光从左侧打过来, 整体色调温暖,奶油色墙面,地上铺浅色地毯。 风格:3D 渲染,温馨治愈感。 要求:无人物,只画环境,重点交代空间结构和光影氛围。 场景图不要把角色画进去,只画环境。 ③故事版分镜(对话篇实际用的) 黑白铅笔草图故事版,12 格面板,4×3 网格排列。 手绘线条风格,细节尽量少,草图质感。 色彩标注系统(所有面板统一使用): - 红色箭头 → 人物身体动作方向 - 蓝色箭头 → 镜头运动方向 - 绿色虚线 → 构图引导线 - 橙色 → 光源方向标记 - 紫色波浪线 → 情绪/能量弧线 - 黑色文字 → 景别标注和动作简述 角色:参照参考图中的月鹿(奶茶棕小鹿)和夜枭(灰蓝猫头鹰) 场景:温馨书房,木质书桌,暖色台灯 第 1 格(0-1秒):近景 - 月鹿托腮对着电脑叹气 第 2 格(1-3秒):近景 - 电脑屏幕上多个视频缩略图,角色各不相同 第 3 格(3-4秒):近景 - 夜枭推眼镜,表情淡定 第 4 格(4-6秒):中景 - 月鹿歪头好奇看夜枭 第 5 格(6-7秒):特写 - 夜枭展示"故事版"字样 第 6 格(7-8秒):近景 - 月鹿竖起耳朵,表情感兴趣 第 7 格(8-10秒):中景 - 夜枭自信指向屏幕上的故事版 第 8 格(10-11秒):近景 - 月鹿眼睛发亮 第 9 格(11-12秒):中景 - 夜枭在电脑前操作 第 10 格(12-13秒):近景 - 屏幕上出现完整的分镜规划 第 11 格(13-14秒):中景 - 月鹿兴奋凑近屏幕 第 12 格(14-15秒):全景 - 两人并肩坐在书桌前,暖灯,温馨收束 把这段提示词连同角色+场景的合并参考图,一起提交给 GPT-image-2。几十秒出一张完整的 12 格故事版。你换场景时,只用改角色、场景和 12 格的镜头内容,前面的格式和标注系统不用动。 ④视频生成提示词(对话篇实际用的) 把故事版图片作为参考图上传给小云雀,文字描述这样写: 根据参考图的 12 格故事版来生成 15 秒视频,9:16 竖屏。 不要生成分镜表格,不要保留 12 格面板布局,不要黑白铅笔草图。 参考图只用于理解镜头顺序、人物动作和叙事节奏。 角色: - 月鹿:奶茶棕毛绒小鹿,金色鹿角,米白围巾配金色月牙吊坠,深棕大圆眼,粉色鼻子腮红 - 夜枭:灰蓝毛绒猫头鹰,金色圆框眼镜,雾蓝针织围巾,大圆眼黄虹膜,黄色短喙 场景:温馨书房,木质书桌,暖黄台灯,书架,奶油色调。 风格:3D 毛绒玩偶动画,画面温暖明亮,角色五官清晰不变形。 记得上传角色和场景参考图,那三句"不要……不要……不要……"是关键。不加的话,出来的视频就是一张分镜表在那动。 一个方向 故事版不是什么新概念,动画行业用了几十年。但以前画故事版本身就是专业活——分镜师画 3 到 5 天。 现在 GPT 几十秒就能出一张 12 格分镜,而且视频模型已经能读懂它。 两件事撞在一起,故事版就从"专业流程"变成了"个人创作者的标配工具"。 月鹿造物 · 不会代码也能造物 短视频 游戏 工作流 视频 系统