Seedance2.0视频提示词实战:20个模板让AI生成电影感画面 原创 于 2026-09-25 14:51:33 发布 · 287 阅读 前阵子AI视频圈又刷起一轮“神级测试”,从鹈鹕骑自行车到各种魔性运镜,满屏都是同一个模型的名字——Seedance2.0。说实话,模型本身确实能打,尤其在中文语义理解和物理规则还原上,已经是第一梯队的水平。但我发现一个很尴尬的现象:同样用Seedance2.0,有人生成的视频流畅得像院线预告片,有人生成的视频却像开了0.5倍速的电子相册。 差别不在运气,全在提示词 。 这篇文章把我这段时间在Seedance2.0上反复试出来的20个提示词全部摊开讲。每个都附了可以直接复制的模板,也讲清楚背后的设计逻辑和最容易翻车的细节。不管你是刚开始玩AI视频的小白,还是已经写过很多提示词想进一步突破的老手,这套东西应该都能帮你少走不少弯路。
1. 为什么同样的Seedance2.0,你生成的是PPT 别人生成的是电影
1.1 视频提示词与文生图 提示词的本质区别 很多人一上来就把文生图的那套提示词习惯搬过来用,写什么“一个女孩站在樱花树下,高清,8k,唯美”。生成出来的结果就是一帧好看的静态画,人物像被点了定身术,背景也不动,整个视频像一张图片被硬拉了几秒。 问题出在哪儿?出在你看待提示词的方式还是“静态思维”。 文生图的任务是决定“画面里有什么”,这个任务在时间轴上是单点采样。视频生成的任务则是在这个基础上,额外决定“接下来的几秒钟里这些东西分别怎么变化”。模型要同时解算主体的位移、物理反馈、镜头运动、光影变化、粒子效果。它需要的不是一句描述,而是一整套“运动计划”。 我打个比方。文生图提示词像是给摄影师描述一张照片——光线、构图、机位、人物状态,足够清楚就够了。视频提示词则像是给导演写一份分镜脚本——这个镜头里谁往哪走、走多快、镜头是推还是摇、走到一半风吹过来头发要往哪个方向飘。你不把这些写明白,导演就只能靠猜,而AI靠猜的结果就是平均化、随机化,偶尔你运气好出个神片,但大概率是一堆废片。 1.2 90%的人都会犯的三个提示词错误 跑了这么多测试,我把最常见的坑总结成三条。不是那种“偶尔翻车”的坑,而是几乎每一条废片里都存在的毛病。 第一个坑:通篇没有一个动词。画面描写是完整的,人物好看的,但所有句子都是“谁在哪里,长什么样”。模型没有收到任何“怎么动”的指令,最后就给你一个几乎静止的人。你提醒自己“加动作”,但加的是“美丽地站着”“优雅地走着”——美丽、优雅这些词属于形容词,不负责运动指令,模型不知道到底要怎么走,不知道速度和幅度。 第二个坑:情绪词堆砌。“梦幻”“震撼”“唯美”“高级感”这些词写到提示词里,确实会影响画面的风格取向,让模型往“风格化”去靠拢,但没法告诉模型水和灰尘到底怎么运动。AI视频最难突破的从来不是色调和氛围,而是物理规律和时间推进。你写十个“震撼”,不如写一句“粒子从中心向外加速扩散”。 第三个坑:不给镜头指令。很多人以为镜头运动是模型自动配的,不是,大部分时候如果你不提镜头,模型默认用一个固定机位朝着主体拍,或者更糟——随机运镜,导致画面一会儿近一会儿远,看得人头晕。视频的魅力恰恰在镜头的调度上,这部分不写,等于把视频最好的武器扔了。 1.3 我多次实测后沉淀的“四段式”模板 我现在给视频写提示词,基本统一用一套结构,成功率比之前瞎写提高了不是一星半点。这套结构我叫它“四段式”: 第一段:主体与场景(画面里有什么) 第二段:物理动态与变化(什么东西在动、怎么动) 第三段:镜头运动(镜头做什么动作) 第四段:风格与氛围(色调、光、质感) 举个例子,我要生成“雨夜一个女孩撑伞走路”的画面,完整提示词是这样: “一个穿米色风衣的女孩走在夜晚的街道上,右手撑着一把透明雨伞;雨水打在伞面上弹起细小的水珠,脚步踩过积水时溅起水花;镜头从侧面中景缓慢跟随,焦点始终保持在人物脸上;霓虹灯光在湿漉漉的地面上形成彩色倒影,电影感,浅景深。” 第一段把画面主体和场景给定住:人物、服装、道具、地点。第二段告诉模型两个“物理事件”:雨水打在伞上的弹跳和水花飞溅。第三段锁死了镜头运动方式:侧面、中景、跟随。第四段统一了风格:霓虹倒影、电影感、浅景深。 这四段看起来简单,但每段都对应一个模型需要明确回答的问题:画面里有什么?哪些东西在变化?镜头怎么参与?整体什么质感?把这四个问题回答了,模型就不需要猜了,它可以把算力集中放在动作质量和画面一致性上,而不是替你瞎编方向。
2. 镜头语言组:5个先让画面活起来的提示词
2.1 五个可直接抄作业的运镜提示词 运镜提示词是我认为最“性价比高”的一类。同样的主体和场景,镜头运动一变,成片质感完全不一样。这组提示词专门解决“画面死板”和“镜头乱晃”两个问题。 编号 提示词名称 核心用途 难易度 01 推镜聚焦 从全景推向人物或主体 低 02 环绕运镜 环绕主体180度以上 中 03 低角度跟拍 贴地跟随奔跑或移动 高 04 一镜到底穿越 连续穿过多个空间 高 05 视角穿越转场 穿过介质进入另一画面 中 01 推镜聚焦 镜头从整体环境开始,缓慢匀速向主体推进,画面由全景逐渐过渡到近景,最终聚焦在人物面部;推进过程中背景自然虚化,产生浅景深效果;主体保持清晰稳定,镜头运动平滑无抖动。 text 这个提示词我愿称之为“新手第一个必跑词”。它的核心价值在于把“推镜头”这个模糊的指令拆成了起幅、运动过程、落幅三段。模型不是真的懂电影术语,你跟它说“推镜”,它说不定只给你一个轻微的景物放大。但你告诉它“从全景过渡到近景,最终聚焦在面部”,它就知道要完成一次有明确起终点的位移。 我实测下来,5秒时长的推镜,速度非常均匀,人物面部在推进过程中没有出现明显的形变。这里有个细节分享:镜头推近之后,人物如果完全静止,画面会有一股奇怪的“摆拍感”。我的解决办法是给主体加一点微动作,比如“目光微微抬起,头发在风中轻轻晃动”,给画面一点生命力。 02 环绕运镜 镜头围绕主体进行180度水平环绕运动,主体始终位于画面中央;环绕过程中前景虚化掠过镜头,环境光线和阴影随视角变化而自然变化;运动速度中等,整体旋转平滑流畅。 text 环绕运镜是AI视频生成里公认的硬骨头,因为模型要同时解决“主体形态保持”和“背景视差变化”。如果只写“环绕拍摄”,模型容易生成旋转过程中人脸越转越歪的画面。这个提示词的关键,是“前景虚化掠过镜头”这一句。 你可以想象一下:没有前景参照物时,模型只是在重新绘制背景;而有了一个不断从左扫到右的虚化前景,空间关系立刻具体了。这就好像坐旋转木马,你感觉到运动是因为柱子不断从你眼前掠过,而不是因为你看远处的房子。另一个更实用的技巧是,如果环绕的是人物,我建议在提示词里补一句“人物随镜头转动而微微转身”,让主体配合镜头做一点动作,成功率会高很多。 03 低角度跟拍 摄像机以贴近地面的低角度跟随主体向前奔跑,镜头从后侧方拍摄;前景的草地或地面快速掠过镜头,主体与镜头之间保持固定距离;运动连续稳定,主体清晰,画面边缘带有轻微运动模糊。 text 低角度跟拍是最容易出“大片感”的运镜之一,但它也是最容易翻车的镜头。很多人写“低角度跟拍”,模型给了个低机位没错,但主体跑起来像个幽灵在平移,腿部动作和地面完全没有交互感。 我的经验里有两个关键描述缺一不可。第一个是“前景快速掠过”,这给模型一个运动速度的参照,没有它,画面背景会像静止贴图。第二个是“主体与镜头之间保持固定距离”,这锁定了跟拍关系,避免镜头忽远忽近导致人物越跑越小。如果你要跟拍的是人,建议在动作描述里明确写“双腿交替向前,落脚自然”,人会比物体难处理得多,尤其是下肢关节。 04 一镜到底穿越 一个连续的长镜头,摄影机匀速向前推进,依次穿过门洞、走廊、大厅三个空间;穿越每个空间的瞬间有短暂的光影明暗变化;镜头全程无剪辑点,所有出现的人物和物体在空间中保持位置一致。 text 一镜到底是用来测试模型连续一致性能力的经典场景。大部分翻车不是因为模型不会运镜,而是因为模型不知道“一镜到底”要穿过什么。你得把这条轨迹上的地理节点告诉它。 我这版提示词里写了“门洞—走廊—大厅”,等于给模型画了一张路线图。实测生成的镜头很惊艳,空间进深感很强,每次穿越门洞时的光线变化也很自然。但这个提示词有个硬性规律:时长越短越容易成功。我个人建议不要超过8秒,超过10秒后,后半段的空间关系崩坏概率直线上升。 05 视角穿越转场 镜头向前穿过一层薄雾,画面由模糊逐渐变为清晰;穿越的瞬间出现光线折射和细小的水滴掠过镜头;穿越前是冷色调,穿越后是暖色调;整个过程无剪辑点,画面无缝衔接。 text 这个提示词的核心是“穿越介质+前后色调对比”。直接写“转场”模型是理解不了的,但“穿过一层薄雾”是一个具象的物理动作,模型知道怎么让画面从模糊到清晰。我加了一个更强的约束:穿越前冷色调,穿越后暖色调。画面色彩的强对比,让观众的大脑自动识别出这是两个空间。 同样思路还可以换成“玻璃”“水面”“雨幕”,介质越具体越好。千万别写“穿越到另一个世界”,模型理解不了,它会直接给你生成一个完全无关的画面。 2.2 运镜提示词最常见的翻车点 这组提示词跑多了,我总结出几个高发问题,写在这里当避坑参考。 第一,别滥用速度词。“快速晃动”“急速推进”这类词会让模型加重运动模糊,十次有八次画面会糊到没法看。想让镜头有力度,用“匀速”“缓慢”“中等速度”反而更稳。 第二,运镜指令一条就够。很多人喜欢一次写上“推近后环绕再拉远”,一个镜头里塞三个运动方向,模型根本编排不出来,结果就是画面鬼畜抖动。要让镜头“表演”,一个镜头只做一件事,想用好几种运镜,拆成多个镜头分别生成。 第三,镜头动得厉害时,主体要给配合动作。镜头推、主体不动,画面是死的;镜头环绕、主体不转身,视觉上会非常诡异。运镜本质上是在为主体服务的,别让镜头和主体各演各的。
3. 人物动态组:4个专治“纸片感”的提示词
3.1 四个让角色活过来的动态提示词 AI视频被吐槽得最多的一点,就是人物像“纸片人”——脸好看,但肢体僵硬,动作是飘着做的,完全没有真实人体的重量感。破解这个问题的关键在于,提示词里要给人物写“物理反馈”。 编号 提示词名称 核心用途 难点 06 微表情落泪 情绪递进式表演 表情过渡自然度 07 自然行走 解决下肢僵硬 脚步与衣摆同步 08 舞蹈组合 连续动作序列 动作节点衔接 09 回眸直视镜头 经典情绪镜头 眼神方向与面部跟随 06 微表情落泪 人物面部特写,表情从平静逐渐过渡到悲伤,眼眶慢慢泛红,一滴泪水从眼角滑落;眼神微微闪烁,嘴唇轻微颤抖;背景静止,镜头固定在人物正前方;柔和的侧光打在脸上,强调面部轮廓。 text 人类面部微表情是AI视频最难啃的区域,任何一点不自然的扭曲都会被镜头放大。这个提示词我刻意用了“逐渐”“慢慢”“微微”这一组程度副词。如果你直接写“崩溃大哭”,模型会跳过中间的过渡状态,一步到位给你一个夸张表情,那就彻底失去微表情的细腻感。 我给它的设计是一条“情绪曲线”:平静→泛红→落泪→颤抖。模型对分步指令的执行力比对强情绪词的执行力要好得多。这个提示词需要多抽几次卡,但在Seedance2.0上生成的成功率已经算可接受。特别提醒:纯表情表演尽量不要加对白,一旦要生成口型,崩坏概率猛增。 07 自然行走 人物从画面左侧向右侧行走,步态自然,双腿交替迈步,膝盖自然弯曲,手臂随之摆动;衣物下摆和头发在行走过程中产生轻微的惯性摆动;镜头中景平行跟拍,人物始终保持在画面中心。 text 走路是AI视频的“照妖镜”,多少模型在走路上原形毕露——脚底在地上滑动,像在溜冰。这版提示词里最关键的是“衣物下摆和头发在行走过程中产生轻微的惯性摆动”。别小看这句,它给模型一个明确的物理反馈指令。人走路时身体在动,衣物和头发因为惯性会延迟跟随,这个细节是判断“真实感”的重要信号。模型并不是真的理解惯性,但你把这个反馈写出来了,它就会在生成时去计算这一层变化。 实测生成的走路画面,脚步落地和地面基本贴合了,不再是悬浮滑行。这里有个小坑:不要写“穿高跟鞋走路”,细高跟状态下模型对脚踝弯曲的表现仍然很不稳定,容易出恐怖片效果。 08 舞蹈组合 人物在舞台中央表演一段现代舞,动作依次为:展开双臂、身体侧转、下蹲、起身旋转;每个动作之间的衔接流畅自然,无卡顿;四肢关节按人体比例弯曲,动作幅度适中;舞台灯光跟随动作变化,地板上有动态光影。 text 舞蹈提示词是人物动态里最容易翻车的类型,原因在于“跳舞”这个动词太宽泛,模型随机编动作时关节扭曲率极高。我的破解方法是把动作序列写出来,给模型一条明确的“动作路径”。就像教小孩跳舞,不能只喊一句“跳一段”,得说“双手打开,转个圈,蹲下去”,一个动作一个动作来。 但我强烈建议,动作节点控制在2到3个最稳。我给的模板是四个动作的版本,Seedance2.0勉强能跑下来,再往上加动作,成功率就明显下滑了。如果你想做更复杂的编排,建议拆成两个镜头,每个镜头只负责两个动作。 09 回眸直视镜头 人物背对镜头站在空旷的场景中,缓慢转身回头,目光最终直视镜头;转身过程中衣角微微扬起,发丝在风中轻轻拂过面颊;背景虚化,镜头保持在与人物面部同高的水平位置;整体氛围带有电影感。 text 回眸这个镜头在短视频平台火到不行,是有道理的。它自带“悬念—揭示”的情绪结构,从看不到表情到看到表情,信息一点点释放。从AI生成的角度看,它也是一个特别友好的动作:半转身、头部转动、眼神定格,序列复杂度不高,但情绪张力足。 我特别注意在这版提示词里加了“衣角微微扬起”和“发丝拂过面颊”两个物理反馈。这是为了给“转身”这个动作增加真实性——人转身时不可能孤零零地转,衣服、头发都会跟着有延迟响应。如果在你的生成结果里眼睛方向不对,我的经验是把“目光直视镜头”这句挪到提示词末尾,模型往往更重视后出现的关键词。 3.2 人物提示词的核心:动作节点与物理反馈 跑完这一组你会发现一个规律:凡是能让模型“分步执行”的提示词,成功率都远高于“一次性给出整体状态”的写法。微表情我给了情绪节点,舞蹈我给了动作节点,走路和回眸我给了物理反馈。这就是人物类提示词的两大支柱。 动作节点相当于给模型画了一条骨架路径,它不需要自己“想象”该怎么动,只需要沿着路径填充细节。而物理反馈(衣摆、发丝、水花)则用来确认人和环境之间发生了真实交互,这部分是让画面摆脱“纸片感”的关键。两者叠加,人物的可信度立刻上来了。
4. 物理特效组:5个让观众以为是实拍的提示词
4.1 五个自然现象与微观物理提示词 AI视频最唬人的不是宏大场面,而是那些细微的物理效果。水花溅起、发丝飘动、火焰蔓延、花瓣坠落,这些我们每天都在看的自然现象,反而最容易暴露模型的短板。因为人对这些东西的物理规律太熟悉了,出一丁点违和都能立刻察觉。 编号 提示词名称 核心用途 出片质感 10 慢动作水花 水滴撞击瞬间的破碎 微距高级感 11 水面涟漪 物体入水的波纹扩散 写实感强 12 头发飘动 风向与发丝细节 氛围拉满 13 火焰燃烧 火苗蔓延与燃物变化 视觉冲击 14 花瓣飘落 慢速粒子运动 唯美转场必备 10 慢动作水花 慢动作镜头下,一滴水从人物发梢滴落,接触地面瞬间炸裂成细小水花;水花以半透明颗粒的形式向四周溅开,在空中短暂悬浮;人物在背景中保持静止;镜头以微距视角捕捉水滴与地面撞击的瞬间。 text 慢动作加微粒效果,是AI视频“看起来很贵”的捷径。这个提示词最核心的指令是“接触地面瞬间炸裂成细小水花”。如果你只写“一滴水滴落”,模型大概率给你一个圆润的水珠直接落地,结束。但“炸裂”这个词会让模型引入一个碰撞计算,水珠撞到地面后要分裂、飞溅、回弹,这番操作下来,画面立刻有了高速摄影的味道。 这段提示词需要多跑几遍,据我的经验,Seedance2.0对粒子解算属于中等偏上水平,跑五次至少有一次能达到发丝级细节。如果生成的水花像一团白色马赛克,可以试试把“半透明颗粒”改成“细小的透明水珠群”,模型对具象名词的理解比抽象质感准确得多。 11 水面涟漪 一颗石子投入平静的水面,入水点泛起一圈圈向外扩散的涟漪;涟漪前端附带一层细小水沫,水面倒影随波纹扭曲变形;镜头保持在水面同一水平高度,光线从斜上方照射,水面闪烁波光。 text 水是最能区分模型水平的元素之一。僵硬的AI水有一个通病:所有波纹的扩散速度一致,像拿尺子比着画的。真实的水面是有阻力的,波纹会逐渐衰减,振幅也不均匀。 这版提示词里,“水面倒影随波纹扭曲变形”是关键。很多人写水面忽略倒影,倒影不跟着波纹走,画面一眼假。我加这一句,等于提醒模型去计算倒影层的动态映射关系。实测的效果很惊喜,涟漪扩散自然,波光也摆脱了那种一秒闪八次的LED灯感。 12 头发飘动 人物侧脸特写,风从画面右侧吹来,发丝在风中轻轻飘动;每缕发丝自然分离,飘动方向一致,发尾拂过面部时产生轻微遮挡;背景虚化,整体光影柔和,发丝边缘有细腻的光泽。 text 头发飘动是细节量最密集的物理效果之一。很多模型的头发一旦动起来就变成“钢丝球”,因为每缕头发在运动中的轨迹不同,模型要同时解算太多曲线。 这个提示词我埋了两个约束:“每缕发丝自然分离”解决的是粘连问题,“飘动方向一致”解决的是方向统一问题。这两个约束给出来,模型就知道发丝之间要有间距、有层次,同时不能乱飞。还有一个很私人的技巧:风向必须明确写清楚。不要写“一阵风吹来”,要写“风从画面右侧吹来”,方向越具体,生成结果越不会变成头发四面八方炸开。 13 火焰燃烧 一簇火焰从纸片边缘燃起,火苗由小到大,沿着纸张边缘蔓延;火苗呈现橙色与黄色交织的内外焰,上方有少量灰烟升起;纸片边缘在燃烧时逐渐卷曲变黑;镜头固定,微距视角,背景为暗色。 text 火焰提示词最大的误区是把注意力全放在火苗上。其实模型生成一个漂亮的火苗很容易,难的是火焰和燃烧物之间的“互动”。真实燃烧的时候,纸张会卷曲、变黑、冒烟,这些才是观众判断真实感的关键。 所以我特意写了“纸片边缘逐渐卷曲变黑”和“灰烟升起”两个副事件,让火焰不再是漂浮在素材库里的贴图,而是真的在烧毁一个物体。这类提示词建议搭配暗色背景,模型在暗背景下处理火焰的亮度和粒子效果更稳定,不会出现过曝的情况。 14 花瓣飘落 樱花花瓣从画面上方缓缓飘落,在空气中旋转、翻转,运动轨迹呈S形曲线;部分花瓣落在镜头前形成虚化前景;光线从侧后方穿透花瓣,使花瓣边缘透亮;背景是模糊的春日树林,整体色调偏浅粉。 text 花瓣飘落是典型的“慢速粒子”效果。很多人写“花瓣飘落”,生成结果就是花瓣直线下坠,一点美感都没有。为什么会这样?因为模型默认会走“最短路径”——如果没有阻力、风向和旋转的约束,物体当然就是垂直下落。 这个提示词里“运动轨迹呈S形曲线”是关键中的关键。几何形状的指令对模型来说特别好理解,比“风在花瓣间流动”这种抽象描述靠谱得多。你也可以把S形换成螺旋形、波浪形,效果完全不同。这个提示词天然适合做转场素材,花瓣飘满全屏后切到下一个镜头,衔接非常自然。 4.2 物理效果提示词为什么不能用“形容词堆砌” 我见过很多人写“唯美、梦幻、震撼、逼真”来追求物理效果,这是方向上的错误。情绪形容词影响的是风格化方向,而物理效果需要的是“动词+结果”的命令结构。 “水面上泛起一圈圈涟漪”——这是动词加结果,模型知道要做什么。 “唯美得让人窒息的水面”——这是形容词加感受,模型只知道你想要一种很漂亮的水,但不知道怎么让水动起来。 写物理效果提示词,我的习惯是:先列三到五个动词(溅起、扩散、卷曲、坠落、炸裂),再给每个动词配一个结果(细小水花、弧形波纹、边缘变黑、旋转飘落、半透明颗粒)。画面要发生什么、发生后变成什么样,交代清楚,模型给出的物理反馈才会具体。
5. 转场与时间组:6个把画面变成故事的提示词
5.1 无缝转场:三个必会镜头切换模板 这组提示词的价值在于,单条AI视频镜头再漂亮也只是“画面”。真正让内容变成“视频”的,是镜头和镜头之间的衔接。转场提示词做得好,视频就有了剪辑感。 编号 提示词名称 核心用途 难度 15 无缝窗帘转场 室内外场景瞬间切换 低 16 Iris Out圆形收缩 复古电影式转场 中 17 物体裂变重组 视觉冲击特效 高 15 无缝窗帘转场 镜头从室内缓缓推向一扇被风吹起的窗帘,窗帘完全展开后遮挡住整个镜头;当窗帘落下时,画面已经切换到室外的开阔场景;室内场景偏暖黄,室外场景偏冷蓝;整个转场过程没有剪辑痕迹。 text 无缝转场的核心思想是“用遮挡物完成场景切换”。窗帘、手、墙面、飞起的衣角,只要画面被大面积遮挡住一瞬,之后的任何场景都不算跳切,观众大脑会自动把这段当作连续画面。 注意我给的提示词里写了“室内偏暖黄、室外偏冷蓝”。这一步不是随便写的,两个场景的色调差异越大,转场的“空间切换感”越明显,模型也越好计算“遮挡前后是两个不同画面”这个任务。如果两边颜色太接近,转场看起来就会像一次穿模而不是一次漂亮的过渡。 16 Iris Out圆形收缩 画面从四周开始向中心收缩变暗,逐渐形成一个不断缩小的圆形可见区域;圆形区域中心的人物在缩小过程中保持清晰可见;当圆形区域缩小成一个点后画面完全变黑,再从黑场中开启新的画面。 text 这个提示词最近在短视频平台非常火,原因是Iris Out是传统电影里很有味道的转场方式,但AI视频很少能做好这种圆形遮罩的收缩动画。我在写的时候特意用了“圆形可见区域”这个描述,而不是“光圈”。 为什么不写“光圈”?因为我实测过,模型会把它理解成镜头光晕,生成出光芒四射那种效果。你要它做的实际上是一个圆形mask动画,老老实实描述成“圆形可见区域”“逐渐缩小”最不容易产生歧义。整个收缩过程的视觉重心要保持在中心主体上,所以“人物在缩小过程中保持清晰可见”也是必要的。 17 物体裂变重组 一个金属立方体静止在桌面中央,表面突然出现裂纹,裂纹逐渐遍布整个立方体;立方体从裂缝处开始向外崩解,碎片向四周飞散;飞散过程中,碎片在空中重新聚合,形成一个透明的玻璃球体;整个转换过程流畅,无多余物体出现。 text 物体变形提示词的本质是“分裂—重组”两阶段。这个物理过程信息量很大,模型通常一次只能做好一半。我的做法是把“分裂”和“重组”都明确写出来,并且给它们一个目标物——玻璃球体。 这里有一个很隐蔽的技巧:给两个物体明确的材质差异。金属和玻璃,一个是高反光不透明,一个是通透半透明,材质差异越大,模型越容易区分“变化前”和“变化后”两个状态。如果你让一个木头盒子变木头杯子,想想都容易糊成一团,因为材质太接近了。 5.2 时间流逝:三个跨时间尺度的模板 编号 提示词名称 核心用途 难度 18 种子破土生长 生长过程连续呈现 中 19 城市一天 光线与云层全时段变化 中 20 季节更替 一棵树的四季切换 高 18 种子破土生长 一颗种子在土壤中破壳,嫩芽顶开泥土钻出,茎秆缓慢向上生长,叶片依次展开;生长过程中泥土微微隆起,周边土粒轻微颤动;镜头微距固定,柔和晨光从侧面照射,投影随着生长过程逐渐拉长。 text 生长类视频本质上是“时间压缩”。模型在几秒钟内要表现真实世界几周的进程,最容易出现的问题是中间帧缺失——前一秒还是芽,后一秒突然变成一米高的苗。我的解决方案是,把生长过程拆成“破壳、茎秆伸长、叶片展开”三个节点,每一步明确写在提示词里。 我更推荐配合微距镜头和固定机位,因为时间跨度大,如果镜头还在大幅度运动,模型的计算负担过重,生成结果很容易乱。Seedance2.0对植物生长类效果表现不错,叶片展开的瞬间能出一种定格动画的沉静美感。 19 城市一天 固定机位拍摄一座城市的天际线,从清晨第一缕阳光开始,云层缓慢流动,天色由粉蓝变为金黄再变为深蓝;城市灯光在黄昏时分逐一亮起;街道上的车流和行人以延时摄影的方式快速穿梭;整段光影变化连续自然。 text 城市一天这类提示词,我最关心的是不要让时间线乱掉...