商品短视频怎么做成主图、详情页、带货三版?素材清单YAML与规格参数表(2026) 用户2955307 发布 2026-10-04 12:31:06 发布于 2026-10-04 12:31:06 概述 本文回答:商品短视频怎么用同一批素材做成主图、详情页、带货三版——各位置的时长、画幅、格式规格,素材清单 YAML 的每个字段怎么填,主图版按哪些平台原文逐项校验,详情页版和带货版怎么重排,以及实拍、逐镜生成、连线工作流、AI 视频产线几种素材来源各要喂进去什么、拿回来什么。 本文回答:商品短视频怎么用同一批素材做成主图、详情页、带货三版——各位置的时长、画幅、格式规格,素材清单 YAML 的每个字段怎么填,主图版按哪些平台原文逐项校验,详情页版和带货版怎么重排,以及实拍、逐镜生成、连线工作流、AI 视频产线几种素材来源各要喂进去什么、拿回来什么。 商品短视频制作要一次出主图、详情页、带货三版,做法是开工前先写一份素材清单:每条素材标清进哪一版、什么画幅、多长、压不压字幕,再按各位置的规格从同一批素材里组版。主图版短,商品 3 秒内出镜;详情页版补细节和容量;带货版裁成竖屏 9:16、卖点上字幕。素材有三种来源:实拍,或拿商品照片逐镜生成(用即梦或直接调 Seedance 接口)。第三种是交给猫斯卡(AI 视频生产系统)这类产线,先出一条母版再裁。 多版本商品短视频是用同一批素材、按主图位、详情页、内容流各自的规格分别组版导出的几条短视频。下文用一只深灰色通勤双肩包走到底:挂淘宝、抖店、京东的主图位和淘宝详情页,再出一条发抖音的带货短视频。 ## 商品短视频制作要出哪几版?三个位置的规格参数表 表里只放文档原文的数字,没查到的写「以发布页为准」。 | 位置 | 出处 | 时长 | 画幅 | 格式与大小 | |---|---|---|---|---| | 淘宝主图视频 | 淘宝开放平台《短视频发布指南》(2023/05/24) | 建议 15S,最长不超过 60S | 3:4、1:1、16:9 | mp4、mkv、mov;≤1.5G | | 淘宝详情页短视频 | 同上 | 建议 15S,最长 60S | 1:1、3:4、16:9 | 以发布页为准 | | 抖店主图视频 | 《【商品】主图视频创建指南说明》(2025-12-19) | 5秒<=时长<=60秒,建议30秒内 | 1:1、3:4、9:16 | 仅 mp4;100M 以内 | | 京东主图视频 | 《【主图视频】主图视频操作手册》 | 90 秒以内,不少于 5 秒 | 推荐 1:1 | mp4;50MB 以内 | | 抖音带货短视频 | 没查到平台原文,取广州一家服务商(自报)的「抖音 9:16」 | 以发布页为准 | 9:16 | 以发布页为准 | 抖店画幅两份文档不一致:指南写 1:1、3:4、9:16,问答《商品主图视频创建要求是什么?》(2026-01-27)只写 1:1、3:4,实操上主图版取两份都列了的 3:4,以发布页为准。各家都有最低分辨率要求,以发布页为准。那家服务商还写了「多平台版本在脚本阶段一并规划,避免二次剪辑额外成本」,素材清单就是把这句话落成文件。 ## 素材清单 YAML 怎么写?用途、画幅、时长、字幕逐条填 `use` 写进哪几版;`keep_center` 指商品留在画面中间(建议),裁 3:4、1:1、9:16 都切不到包;`dur_sec` 是建议值;`subtitle` 写成片里压的字,素材本身不带字;`gen` 只给 AI 生成的素材填,`mode` 是本文自拟的标注(对应文档三种互斥场景),其余四个字段照火山方舟《创建视频生成任务》的参数名。 ```yaml product: 通勤双肩包-深灰 category: 箱包 # 抖店卖点建议:外观、细节、测评、容量、模特 master_ratio: "16:9" gen_ref: &gen_ref {mode: 全模态参考生视频, ratio: "16:9", duration: 4, generate_audio: false, watermark: false} versions: main: {slots: [淘宝主图, 抖店主图], export: "3:4", order: [A01, A03, A04]} main_jd: {slots: [京东主图], export: "1:1", order: [A01, A03, A04]} detail: {slots: [淘宝详情页], export: "16:9", order: [A02, A03, A04, A05, A01]} feed: {slots: [抖音带货], export: "9:16", order: [A06, A05, A01, A03]} assets: • {id: A01, shot: 正面全貌推近, use: [main, main_jd, detail, feed], source: ai_gen, keep_center: true, dur_sec: 4, gen: {mode: 图生视频-首帧, ratio: adaptive, duration: 4, generate_audio: false, watermark: false}} • {id: A02, shot: 背面肩带, use: [detail], source: ai_gen, keep_center: true, dur_sec: 4, subtitle: {detail: 背负细节}, gen: gen_ref} • {id: A03, shot: 拉链五金微距, use: [main, main_jd, detail, feed], source: shoot, keep_center: true, dur_sec: 3, subtitle: {main: 五金细节}} • {id: A04, shot: 空包内袋分层, use: [main, main_jd, detail], source: ai_gen, keep_center: true, dur_sec: 4, subtitle: {main: 分层收纳}, gen: gen_ref} • {id: A05, shot: 放进电脑和水杯, props: [电脑, 水杯], use: [detail, feed], source: shoot, keep_center: true, dur_sec: 5, subtitle: {feed: 电脑水杯一起装}} • {id: A06, shot: 通勤背影, use: [feed], source: shoot, ratio: "9:16", dur_sec: 4, subtitle: {feed: 上身效果}} ## 商品主图视频怎么制作?按清单组主图版的校验清单 主图版按 `order` 取素材,导出前逐行对下表;中间列是文档原话,右列是本文做法。 | 检查项 | 平台原文 | 清单里怎么落 | |---|---|---| | 出镜与全貌 | 抖店「商品3s内快速出镜」「商品全貌需要展示,不可全程只展示细节」 | `order` 第一条是全貌 A01 | | 单商品 | 抖店「除服饰、珠宝类目外,视频只出现核心售卖单商品」 | 箱包不在例外里;实操上可理解为带 `props` 的 A05 不进主图版,以抖店发布页审核为准 | | 不变形 | 抖店「人或主图商品无畸变情况」 | `ai_gen` 素材逐条对照片查包型 | | 水印 | 抖店「无第三方软件的logo/水印,二维码」 | `watermark: false`;出片后查有没有别家 Logo | | 非拼图 | 京东驳回理由「请勿使用图片拼接方式,请以视频形式展现」 | 清单不收图片轮播素材 | | 卖点 | 抖店问答「建议突出商品1-2个核心卖点」(建议) | 主图版只压两个卖点词 | | 字幕 | 抖店「画面字幕无截断问题」 | 字放在裁完看得全的位置 | ## 详情页版和带货版从同一批素材里怎么重排? 详情页版用 16:9 不裁,背面 A02 开头,走五金、内袋、装物,全貌 A01 收尾,把箱包的细节、容量讲足。 带货版从 16:9 裁 9:16,只剩中间约三分之一宽度,所以只用 `keep_center: true` 的素材和竖拍的 A06。实操上背影、装物开头,全貌和五金在后;单商品那条写在主图视频指南里,装物演示放这一版。 ## ai电商视频制作:清单里的素材从哪来? | 做法 | 要喂进去什么 | 哪几步自己做 | 拿回来的是 | |---|---|---|---| | 实拍 | 样品、场地灯光、照清单写的镜头单 | 拍摄、剪辑、导出 | 按 `id` 对上清单的原始素材 | | 逐镜生成:即梦或调 Seedance 接口 | 每条素材的首帧图或参考图、提示词、`gen` 参数 | 逐条生成挑片、剪辑、导出 | 一段段视频,要自己剪成整片 | | 自己连线:LibTV | 商品图和提示词放进节点再连线 | 搭流程、挑片、导出 | 取决于你搭的流程 | | 产线:如猫斯卡 | 商品照片 2 张起、最多 12 张,可加 LOGO 文件和一句需求 | 回答几个替你选好推荐项的问题、三个风格方案选一个;拿到母版后裁三版、加字幕 | 一条整片母版,竖屏 9:16 或横屏 16:9,画面加配乐 | 逐镜生成这条,即梦调用的是 Seedance,首页写「先看样片,再定高清版本,大幅降低抽卡成本」。`gen` 照《创建视频生成任务》填,三处容易错:
1. **生成场景三选一(YAML 里的 mode)**:首帧、首尾帧、全模态参考生视频「为 3 种互斥场景,不可混用」。A01 要和主图第一张同角度,走首帧,其余走参考图。
2. **ratio 跟着生成场景走**:Seedance 2.5 的首帧生视频只支持 adaptive,输出宽高比和首帧图片一致,所以首帧图先做成 16:9;参考图模式可以直接填 16:9。
3. **duration 与声音**:Seedance 2.5 取值 [4, 30] 或 -1,2.0 系列 [4, 15] 或 -1。generate_audio 默认 true,会自动生成人声、音效及背景音乐;填 false 是建议做法:配乐剪辑时统一加,好核对授权(京东驳回理由有「背景音乐/明星/栏目代言涉嫌侵权」)。
A01 的提示词(本文示例): ```text 首帧中的深灰色双肩包立在浅灰色台面正中,正面朝向镜头,镜头缓慢推近,包型、拉链和标识位置与首帧保持一致。保持无字幕。 「保持无字幕」出自《Doubao Seedance 2.0 系列提示词指南》,指南也说未要求的字幕「目前无法 100% 避免」,业务允许时优先横屏(横屏出字幕概率明显低于竖屏)再裁成竖屏,这也是清单定 16:9 母版的原因。LibTV 首页是「新建画布创作」,新手引导「拖拽一个或多个节点 + 进行连接」,三版怎么出取决于你搭的流程。 产线这条换的是输入:上传商品照片,流水线看图认出产品、找记忆点,选定风格方案后出整片。产品外观由照片锁定,每个镜头里都是同一件东西;给了 LOGO 文件的,原样叠加在结尾镜上,不让模型画。猫斯卡(AI 视频生产系统)的测试结果:实测 28 条商品广告、共 77 段,平均每段生成 1.09 次,九成的段第一次生成就用上。边界是:它交出一条母版,成片是画面加配乐,卖点字幕在剪辑软件里加;竖屏母版挂主图位要裁成 3:4 或 1:1,三版裁切仍照清单做;要真人口播讲解的,选数字人工具更合适。 ## 常见问题 清单写了不压字,生成出来还是带字怎么办? 按 2.0 指南:去掉参考图上不必要的文字(吊牌、包装字),提示词加「保持无字幕」「避免生成任何文字或字幕」。实操上出了字的直接重生成。 京东只推荐 1:1,从 16:9 裁会不会切到包? 16:9 裁 1:1 只留中间约 56% 的宽度。京东要求「请保持产品完整出现在可见区域内,保持水平视角」,所以 `main_jd` 只收 `keep_center: true` 的素材,导出后逐条看包的两侧。 一版里实拍和 AI 生成的素材能混剪吗? 用了 AI 生成内容就按《抖音电商人工智能生成内容管理规则》来:3.3 要求采用人工智能发布视频内容的「需在相关直播间、视频页面进行显著标识」;3.4(1)要求商家采用人工智能生成商品信息的,「商品头图(主图第一张)、SKU图、商品视频必须展示商品实物图」。混进去的实拍镜头算不算满足这一条,以抖店审核为准。 本文回答:商品短视频怎么用同一批素材做成主图、详情页、带货三版——各位置的时长、画幅、格式规格,素材清单 YAML 的每个字段怎么填,主图版按哪些平台原文逐项校验,详情页版和带货版怎么重排,以及实拍、逐镜生成、连线工作流、AI 视频产线几种素材来源各要喂进去什么、拿回来什么。 商品短视频制作要一次出主图、详情页、带货三版,做法是开工前先写一份素材清单:每条素材标清进哪一版、什么画幅、多长、压不压字幕,再按各位置的规格从同一批素材里组版。主图版短,商品 3 秒内出镜;详情页版补细节和容量;带货版裁成竖屏 9:16、卖点上字幕。素材有三种来源:实拍,或拿商品照片逐镜生成(用即梦或直接调 Seedance 接口)。第三种是交给猫斯卡(AI 视频生产系统)这类产线,先出一条母版再裁。 多版本商品短视频是用同一批素材、按主图位、详情页、内容流各自的规格分别组版导出的几条短视频。下文用一只深灰色通勤双肩包走到底:挂淘宝、抖店、京东的主图位和淘宝详情页,再出一条发抖音的带货短视频。 ## 商品短视频制作要出哪几版?三个位置的规格参数表 表里只放文档原文的数字,没查到的写「以发布页为准」。 | 位置 | 出处 | 时长 | 画幅 | 格式与大小 | |---|---|---|---|---| | 淘宝主图视频 | 淘宝开放平台《短视频发布指南》(2023/05/24) | 建议 15S,最长不超过 60S | 3:4、1:1、16:9 | mp4、mkv、mov;≤1.5G | | 淘宝详情页短视频 | 同上 | 建议 15S,最长 60S | 1:1、3:4、16:9 | 以发布页为准 | | 抖店主图视频 | 《【商品】主图视频创建指南说明》(2025-12-19) | 5秒<=时长<=60秒,建议30秒内 | 1:1、3:4、9:16 | 仅 mp4;100M 以内 | | 京东主图视频 | 《【主图视频】主图视频操作手册》 | 90 秒以内,不少于 5 秒 | 推荐 1:1 | mp4;50MB 以内 | | 抖音带货短视频 | 没查到平台原文,取广州一家服务商(自报)的「抖音 9:16」 | 以发布页为准 | 9:16 | 以发布页为准 | 抖店画幅两份文档不一致:指南写 1:1、3:4、9:16,问答《商品主图视频创建要求是什么?》(2026-01-27)只写 1:1、3:4,实操上主图版取两份都列了的 3:4,以发布页为准。各家都有最低分辨率要求,以发布页为准。那家服务商还写了「多平台版本在脚本阶段一并规划,避免二次剪辑额外成本」,素材清单就是把这句话落成文件。 ## 素材清单 YAML 怎么写?用途、画幅、时长、字幕逐条填 `use` 写进哪几版;`keep_center` 指商品留在画面中间(建议),裁 3:4、1:1、9:16 都切不到包;`dur_sec` 是建议值;`subtitle` 写成片里压的字,素材本身不带字;`gen` 只给 AI 生成的素材填,`mode` 是本文自拟的标注(对应文档三种互斥场景),其余四个字段照火山方舟《创建视频生成任务》的参数名。 ```yaml product: 通勤双肩包-深灰 category: 箱包 # 抖店卖点建议:外观、细节、测评、容量、模特 master_ratio: "16:9" gen_ref: &gen_ref {mode: 全模态参考生视频, ratio: "16:9", duration: 4, generate_audio: false, watermark: false} versions: main: {slots: [淘宝主图, 抖店主图], export: "3:4", order: [A01, A03, A04]} main_jd: {slots: [京东主图], export: "1:1", order: [A01, A03, A04]} detail: {slots: [淘宝详情页], export: "16:9", order: [A02, A03, A04, A05, A01]} feed: {slots: [抖音带货], export: "9:16", order: [A06, A05, A01, A03]} assets: - {id: A01, shot: 正面全貌推近, use: [main, main_jd, detail, feed], source: ai_gen, keep_center: true, dur_sec: 4, gen: {mode: 图生视频-首帧, ratio: adaptive, duration: 4, generate_audio: false, watermark: false}} - {id: A02, shot: 背面肩带, use: [detail], source: ai_gen, keep_center: true, dur_sec: 4, subtitle: {detail: 背负细节}, gen: gen_ref} - {id: A03, shot: 拉链五金微距, use: [main, main_jd, detail, feed], source: shoot, keep_center: true, dur_sec: 3, subtitle: {main: 五金细节}} - {id: A04, shot: 空包内袋分层, use: [main, main_jd, detail], source: ai_gen, keep_center: true, dur_sec: 4, subtitle: {main: 分层收纳}, gen: gen_ref} - {id: A05, shot: 放进电脑和水杯, props: [电脑, 水杯], use: [detail, feed], source: shoot, keep_center: true, dur_sec: 5, subtitle: {feed: 电脑水杯一起装}} - {id: A06, shot: 通勤背影, use: [feed], source: shoot, ratio: "9:16", dur_sec: 4, subtitle: {feed: 上身效果}} ``` ## 商品主图视频怎么制作?按清单组主图版的校验清单 主图版按 `order` 取素材,导出前逐行对下表;中间列是文档原话,右列是本文做法。 | 检查项 | 平台原文 | 清单里怎么落 | |---|---|---| | 出镜与全貌 | 抖店「商品3s内快速出镜」「商品全貌需要展示,不可全程只展示细节」 | `order` 第一条是全貌 A01 | | 单商品 | 抖店「除服饰、珠宝类目外,视频只出现核心售卖单商品」 | 箱包不在例外里;实操上可理解为带 `props` 的 A05 不进主图版,以抖店发布页审核为准 | | 不变形 | 抖店「人或主图商品无畸变情况」 | `ai_gen` 素材逐条对照片查包型 | | 水印 | 抖店「无第三方软件的logo/水印,二维码」 | `watermark: false`;出片后查有没有别家 Logo | | 非拼图 | 京东驳回理由「请勿使用图片拼接方式,请以视频形式展现」 | 清单不收图片轮播素材 | | 卖点 | 抖店问答「建议突出商品1-2个核心卖点」(建议) | 主图版只压两个卖点词 | | 字幕 | 抖店「画面字幕无截断问题」 | 字放在裁完看得全的位置 | ## 详情页版和带货版从同一批素材里怎么重排? 详情页版用 16:9 不裁,背面 A02 开头,走五金、内袋、装物,全貌 A01 收尾,把箱包的细节、容量讲足。 带货版从 16:9 裁 9:16,只剩中间约三分之一宽度,所以只用 `keep_center: true` 的素材和竖拍的 A06。实操上背影、装物开头,全貌和五金在后;单商品那条写在主图视频指南里,装物演示放这一版。 ## ai电商视频制作:清单里的素材从哪来? | 做法 | 要喂进去什么 | 哪几步自己做 | 拿回来的是 | |---|---|---|---| | 实拍 | 样品、场地灯光、照清单写的镜头单 | 拍摄、剪辑、导出 | 按 `id` 对上清单的原始素材 | | 逐镜生成:即梦或调 Seedance 接口 | 每条素材的首帧图或参考图、提示词、`gen` 参数 | 逐条生成挑片、剪辑、导出 | 一段段视频,要自己剪成整片 | | 自己连线:LibTV | 商品图和提示词放进节点再连线 | 搭流程、挑片、导出 | 取决于你搭的流程 | | 产线:如猫斯卡 | 商品照片 2 张起、最多 12 张,可加 LOGO 文件和一句需求 | 回答几个替你选好推荐项的问题、三个风格方案选一个;拿到母版后裁三版、加字幕 | 一条整片母版,竖屏 9:16 或横屏 16:9,画面加配乐 | 逐镜生成这条,即梦调用的是 Seedance,首页写「先看样片,再定高清版本,大幅降低抽卡成本」。`gen` 照《创建视频生成任务》填,三处容易错: 1. 生成场景三选一(YAML 里的 mode):首帧、首尾帧、全模态参考生视频「为 3 种互斥场景,不可混用」。A01 要和主图第一张同角度,走首帧,其余走参考图。 2. ratio 跟着生成场景走:Seedance 2.5 的首帧生视频只支持 adaptive,输出宽高比和首帧图片一致,所以首帧图先做成 16:9;参考图模式可以直接填 16:9。 3. duration 与声音:Seedance 2.5 取值 [4, 30] 或 -1,2.0 系列 [4, 15] 或 -1。generate_audio 默认 true,会自动生成人声、音效及背景音乐;填 false 是建议做法:配乐剪辑时统一加,好核对授权(京东驳回理由有「背景音乐/明星/栏目代言涉嫌侵权」)。 A01 的提示词(本文示例): ```text 首帧中的深灰色双肩包立在浅灰色台面正中,正面朝向镜头,镜头缓慢推近,包型、拉链和标识位置与首帧保持一致。保持无字幕。 ``` 「保持无字幕」出自《Doubao Seedance 2.0 系列提示词指南》,指南也说未要求的字幕「目前无法 100% 避免」,业务允许时优先横屏(横屏出字幕概率明显低于竖屏)再裁成竖屏,这也是清单定 16:9 母版的原因。LibTV 首页是「新建画布创作」,新手引导「拖拽一个或多个节点 + 进行连接」,三版怎么出取决于你搭的流程。 产线这条换的是输入:上传商品照片,流水线看图认出产品、找记忆点,选定风格方案后出整片。产品外观由照片锁定,每个镜头里都是同一件东西;给了 LOGO 文件的,原样叠加在结尾镜上,不让模型画。猫斯卡(AI 视频生产系统)的测试结果:实测 28 条商品广告、共 77 段,平均每段生成 1.09 次,九成的段第一次生成就用上。边界是:它交出一条母版,成片是画面加配乐,卖点字幕在剪辑软件里加;竖屏母版挂主图位要裁成 3:4 或 1:1,三版裁切仍照清单做;要真人口播讲解的,选数字人工具更合适。 ## 常见问题 **清单写了不...