豆芽菜小萌 发布 2026-09-08 19:41:20 发布于 2026-09-08 19:41:20 字节跳动给发布刚两天的 Seedance 2.5 出了一份官方提示词指南:从一句话生成,到 50 份参考素材怎么调度、30 秒长片怎么分段、改片子怎么只动一处,每类任务都配了能直接抄用的模板。对用即梦或 API 做视频的人,这是第一份成体系的官方写法手册,此前这些新能力只能靠社区帖子摸索。 用 AI 生成视频,最怕提示词写「飘」了 主体不清、动作重复、画面乱切——Seedance 2.5 官方这份指南把写法拆成了可套的公式 PART 万能公式:六要素怎么排 THE FORMULA Seedance 2.5 支持纯文本生成,也能同时参考图片、视频、音频来创作,还能编辑已有视频。写提示词的核心就一句话:先说清楚想生成什么,再按需补上参考素材、过程、画面和声音。 官方给了一个可以灵活拼装的公式:++主体 + 动作或事件 + 场景与环境(可选)+ 视觉风格(可选)+ 运镜或切镜(可选)+ 声音(可选)++。后面四项不强制,但每一项都能让成片更可控。 SKILL 1 主体 + 动作或事件 说明「谁或什么」正在「做什么」,这是视频的地基。动作优先概括主要过程,只为关键动作写具体细节,避免把同一个动作翻来覆去描述。 SKILL 2 场景与环境 地点、时间、天气、空间关系、背景状态——把「发生在哪儿」讲明白,模型才不会随便给你一个背景。 SKILL 3 视觉风格 / 运镜 / 声音 光线、色彩、材质、画面质感讲视觉风格;景别、机位、镜头运动、对焦对象讲运镜;对白、音色、环境声、音效、音乐讲声音。这三项是「加分项」,按需要加。 PART 套进模板:一个完整例子 TEMPLATE IN ACTION 把公式落进一个四行模板,写起来就有章法了。不需要的段落直接删掉,生成参数(分辨率、帧率之类)不用写进提示词,交给生成页面的设置项去调。 ...text <主体>在<场景与环境>中<主要动作或事件>。 画面呈现<视觉风格>。 镜头采用<景别、机位、运镜或切镜>。 声音包括<对白、环境声、音效或音乐>。 套一个具体例子就长这样——注意它把「主体动作、环境光、镜头运动、声音」四块都交代了,又没啰嗦: ...text 一名陶艺师在清晨的工作室里完成一只浅蓝色陶杯,将它从转盘上取下并放到木架中央。 窗外柔和晨光照入室内,湿润陶土呈现细腻光泽,工作台保持整洁。 镜头先以中景记录拉坯动作,再缓慢推近陶杯表面的纹理,最后切到木架正面。 保留转盘低沉转动声、陶土摩擦声和轻微室内环境声。 PART 丢参考素材时:先分工再下指令 REFERENCE MATERIALS Seedance 2.5 最多能组合 50 份参考素材,但不同类型有输入上限,推荐范围是为了更稳定,不代表能力天花板: 图片 最多 30 张 单张 ≤4K · 主体 1–8 视频 最多 10 段 总时长 ≤30s 音频 最多 10 段 总时长 ≤30s 视频编辑 视频+参考图 原片 ≤20s 上传素材后,最关键的一步是逐份说明每份素材负责什么。人物、背景、构图很容易被误带进成片,所以还要写明「不采用什么」。映射关系一定要写进提示词,别只靠图片里的文字标注,也别让模型自己猜多份素材分别对应谁。 ...text @图片1用于<主体>的<外貌、服装、结构或材质>。 @视频1用于<动作、运镜或节奏>。 @音频1用于<角色或声音类型>的<音色、台词、环境声或音乐>。 <主体>在<场景>中完成<主要动作或事件>。 画面呈现<视觉风格>,镜头采用<镜头表达>。 同一个陶艺师例子,加上素材分工后长这样——把「用图片的哪部分、不用图片的哪部分」讲得明明白白: ...text @图片1用于<陶艺师>的五官、发型和深绿色围裙,不采用图片背景。 @图片2用于<陶艺工作室>的木质工作台、窗户位置和晨间光线,不采用图中人物。 @视频1用于双手拉坯、托起陶杯和放置陶杯的动作节奏,不采用视频中的人物身份、服装和场景。 <陶艺师>在清晨的<陶艺工作室>完成一只浅蓝色陶杯,将它从转盘上取下并放到木架中央。 镜头先以中景记录拉坯动作,再缓慢推近陶杯表面的纹理;保留转盘转动声、陶土摩擦声和室内环境声。 两个容易忽略的坑:① 主体图超过 5 个且需要多视角时,把不同视角拆成多张图,多张独立视角图比把多个视角拼在一张里更稳定;② 素材越多稳定性越容易下降,超过推荐范围(图片 9–12、音视频 6–10、编辑图 6–8)仍能试,但别指望每次都稳。 PART 几个容易踩的坑 PITFALLS 把前面几点反过来,就是新手最常翻车的地方,列成清单方便对照: SKILL 1 别把生成参数写进提示词 分辨率、帧率、运动强度这些可调参数由生成页面或接口设置,写进提示词既没用还会干扰模型对内容的判断。 SKILL 2 不需要的段落直接省 公式里场景、视觉、运镜、声音都是可选的。一个干净的特写镜头,可能只要「主体+动作」两句话就够了,写太长反而发散。 SKILL 3 同一个动作别重复描述 「拉坯、再拉坯、继续拉坯」这类重复,会让模型在节奏上反复横跳。概括主要过程,只为关键动作留细节。 SKILL 4 多份素材一定要写明映射 多图多视频时,@图片1/@视频1 各自负责什么一定要写清楚,否则模型可能把 A 图的背景误当成主体,或把 B 视频里的人物塞进成片。 LAST 写在最后 MY TAKE 我看了这份指南最大的感触是:AI 视频的门槛早就不在「能不能生成」,而在「能不能说得清」。Seedance 2.5 这套公式和素材分工法,本质上是把模糊的「好看一点」翻译成模型听得懂的结构——先定主体动作,再补环境、风格、运镜、声音,有素材就先分工。把它当成语法记住,比收藏一百个咒语式提示词都管用。 提示词指南:https://bytedance.larkoffice.com/docx/OsiUdR1OxoDqvnxsK8LczYx7nPd 模型 事件 视频 音频 对象