Seedance 2.0 系列模型(包括 Seedance 2.0 和 Seedance 2.0 fast )支持图像、视频、音频、文本等多种模态内容输入,具备视频生成、视频编辑、视频延长等能力,可高精度还原物品细节、音色、效果、风格、运镜等,保持稳定角色特征,赋予使用者如同导演般的掌控权。本文介绍 Seedance 2.0 系列模型的专属能力,帮助您快速实现 Video Generation API 调用。 说明 Seedance 2.0 及 Seedance 2.0 fast API 现已面向 企业用户 开启公测。参与公测请 提交申请,审核结果将以短信形式另行通知,请您耐心等候。 新手入门 本入门教程专为 API 新手用户 设计,帮助您一键搭建 Python 开发环境、完成虚拟环境创建和方舟 SDK 安装,并提供直接可运行的 seedance 2.0 示例代码,您只需修改对应的输入素材,即可开始您的视频生成创作。
1. 准备工作
在开始之前,请确保您已经完成以下准备: 注册账号 :确保您拥有火山引擎账号并已 登录 获取 API Key :访问 API Key 管理页面 ,点击 创建 API Key ,并复制保存您的 API Key。注意请妥善保管您的 API Key,不要泄露给他人。 开通模型(可选) :所有新用户可使用免费额度体验模型服务。如额度使用完毕需要 开通模型 ,以继续使用方舟模型服务。 下载并解压文件 :点击下载下方附件,将其解压到您的本地目录(如桌面或“下载”文件夹)。 ark_seedance2.0_quickstart_package.zip 2.操作步骤 Windows 用户 macOS 用户 打开终端,进入 scripts/init_dev_env 目录。 运行构建脚本: ./setup_mac.sh 脚本会自动配置好所有环境。 完成后,在项目根目录会生成一个 run_demo.sh。 运行 ./run_demo.sh 即可运行 Python SDK 示例代码(python/demo_standard.py)。 进入 scripts/init_dev_env 目录。 双击运行 setup_windows.bat 。 脚本会自动执行以下操作: 下载 uv 工具。 自动下载 Python 3.12(如果不干扰您的系统 Python)。 创建虚拟环境 . venv 。 安装方舟 SDK。 完成后,在项目根目录会生成一个 run_demo.bat。 双击 run_demo.bat,即可运行 Python SDK 示例代码(python/demo_standard.py)。 3.运行说明 运行脚本后,您将看到如下流程: API Key 校验 :脚本会自动检测您本地是否配置了 ARK_API_KEY 环境变量。如果没有,会提示您手动输入。 素材预览 :脚本会自动在您的默认浏览器中弹出一个本地生成的 HTML 页面,直观地展示本次任务的文本提示词、待替换的参考图片以及原始参考视频。 任务创建与轮询 :脚本向火山方舟服务器发起异步请求。由于视频生成需要一定时间,控制台会每隔 30 秒打印一次任务状态(如 running 获取结果 :任务成功后,控制台会输出一段最终生成的视频 URL。您可以复制该链接到浏览器下载或在线播放。 4.下一步 在成功跑通本示例后,您可以尝试修改 python/demo_standard.py ,来打造您专属的视频生成任务: 修改文本提示词 找到代码中的 user_content 变量,更改为您想要的画面描述。 替换输入素材 (图片、视频、音频) 您可以将 reference_image_url reference_video_url reference_audio_url 替换为您自己的素材链接。 注意 :请确保 URL 是公网可公开访问的链接(建议存放在 TOS 对象存储服务中,并配置为公共读)。 继续学习下文中丰富的使用示例。 模型能力 Seedance 2.0 fast 和 Seedance 2.0 的模型能力相同。追求最高生成品质,推荐使用 Seedance 2.0;更注重成本与生成速度,不要求极限品质,推荐使用 Seedance 2.0 fast。 模型名称 Seedance 2.0 Seedance 2.0 fast Model ID doubao-seedance-2-0-260128 doubao-seedance-2-0-fast-260128 文生视频 图生视频-首帧 图生视频-首尾帧 多模态参考【New】 图片参考 视频参考 组合参考 图片 + 音频 图片 + 视频 视频 + 音频 图片 + 视频 + 音频 编辑视频【New】 延长视频【New】 生成有声视频 联网搜索增强【New】 样片模式 返回视频尾帧 输出视频规格 输出分辨率 480p, 720p 480p, 720p 输出宽高比 21:9, 16:9, 4:3, 1:1, 3:4, 9:16 输出时长 4~15 秒 4~15 秒 输出视频格式 离线推理 在线推理限流 并发数 离线推理限流 基础使用 多模态参考 输入文本、参考图、视频(可带音轨)和音频等内容,来生成一段新视频。可继承参考图片的角色形象、视觉风格、画面构图;参考视频的主体内容、运镜方式、动作表现、整体风格;以及参考音频的音色、音乐旋律、对话内容等核心信息。 效果预览如下(访问 模型卡片 输入:文本 输入:图片、视频、音频 输出 全程使用视频1的第一视角构图,全程使用音频1 作为背景音乐。第一人称视角果茶宣传广告,seedance牌「苹苹安安」苹果果茶限定款;首帧为图片1,你的手摘下一颗带晨露的阿克苏红苹果,轻脆的苹果碰撞声;2-4 秒:快速切镜,你的手将苹果块投入雪克杯,加入冰块与茶底,用力摇晃,冰块碰撞声与摇晃声卡点轻快鼓点,背景音:「鲜切现摇」;4-6 秒:第一人称成品特写,分层果茶倒入透明杯,你的手轻挤奶盖在顶部铺展,在杯身贴上粉红包标,镜头拉近看奶盖与果茶的分层纹理;6-8 秒:第一人称手持举杯,你将图片2中的果茶举到镜头前(模拟递到观众面前的视角),杯身标签清晰可见,背景音「来一口鲜爽」,尾帧定格为图片2。背景声音统一为女生音色。 00:00/00:00 2X快进中 重播 播放 00:00/00:00直播 00:00 00:00 进入全屏 1.5x 0.75x 0.5x 点击按住可拖动视频 r2v_tea_audio1.mp3 00:00/00:00 2X快进中 重播 播放 00:00/00:00直播 00:00 00:00 进入全屏 1.5x 0.75x 0.5x 点击按住可拖动视频 Python Python import os import time # Install SDK: pip install 'volcengine-python-sdk[ark]' from volcenginesdkarkruntime import Ark client = Ark( # The base URL for model invocation base_url='https://ark.cn-beijing.volces.com/api/v3', # Get API Key:https://console.volcengine.com/ark/region:ark+cn-beijing/apikey api_key=os.environ.get("ARK_API_KEY"), if __name__ == "__main__": print("----- create request -----") create_result = client.content_generation.tasks.create( model="doubao-seedance-2-0-260128", # Replace with Model ID content=[ "type": "text", "text": "全程使用视频1的第一视角构图,全程使用音频1作为背景音乐。第一人称视角果茶宣传广告,seedance牌「苹苹安安」苹果果茶限定款;首帧为图片1,你的手摘下一颗带晨露的阿克苏红苹果,轻脆的苹果碰撞声;2-4 秒:快速切镜,你的手将苹果块投入雪克杯,加入冰块与茶底,用力摇晃,冰块碰撞声与摇晃声卡点轻快鼓点,背景音:「鲜切现摇」;4-6 秒:第一人称成品特写,分层果茶倒入透明杯,你的手轻挤奶盖在顶部铺展,在杯身贴上粉红包标,镜头拉近看奶盖与果茶的分层纹理;6-8 秒:第一人称手持举杯,你将图片2中的果茶举到镜头前(模拟递到观众面前的视角),杯身标签清晰可见,背景音「来一口鲜爽」,尾帧定格为图片2。背景声音统一为女生音色。", "type": "image_url", "image_url": { "url": "https://ark-project.tos-cn-beijing.volces.com/doc_image/r2v_tea_pic1.jpg" "role": "reference_image", "type": "image_url", "image_url": { "url": "https://ark-project.tos-cn-beijing.volces.com/doc_image/r2v_tea_pic2.jpg" "role": "reference_image", "type": "video_url", "video_url": { "url": "https://ark-project.tos-cn-beijing.volces.com/doc_video/r2v_tea_video1.mp4" "role": "reference_video", "type": "audio_url", "audio_url": { "url": "https://ark-project.tos-cn-beijing.volces.com/doc_audio/r2v_tea_audio1.mp3" "role": "reference_audio", generate_audio=True, ratio="16:9", duration=11, watermark=True, print(create_result) # Polling query section print("----- polling task status -----") task_id = create_result.id while True: get_result = client.content_generation.tasks.get(task_id=task_id) status = get_result.status if status == "succeeded": print("----- task succeeded -----") print(get_result) break elif status == "failed": print("----- task failed -----") print(f"Error: {get_result.error}") break else: print(f"Current status: {status}, Retrying after 30 seconds...") time.sleep(30) 说明 您可任意组合以下模态内容,注意不支持“文本+音频”、“纯音频” 输入。 文本 图片:0~9 张 视频:0~3 个 音频:0~3 个 进阶用法 :多模态生视频可通过提示词指定参考图片作为首帧/尾帧,间接实现“首尾帧+多模态参考”效果。若需严格保障首尾帧和指定图片一致, 优先使用图生视频-首尾帧 (配置 role 为 first_frame/last_frame)。 各个模态信息输入要求参见 多模态输入 编辑视频 您可以提供待编辑的视频、参考图片或音频,并结合使用提示词,完成多种视频编辑任务,例如:替换视频主体、视频中对象增删改、局部画面重绘/修复等。 效果预览如下(访问 模型卡片 输入:文本 输入:视频&图片 输出 将视频1礼盒中的香水替换成图像1中的面霜,运镜不变 00:00/00:00 2X快进中 重播 播放 00:00/00:00直播 00:00 00:00 进入全屏 1.5x 0.75x 0.5x 点击按住可拖动视频 00:00/00:00 2X快进中 重播 播放 00:00/00:00直播 00:00 00:00 进入全屏 1.5x 0.75x 0.5x 点击按住可拖动视频 Python Python import os import time # Install SDK: pip install 'volcengine-python-sdk[ark]' from volcenginesdkarkruntime import Ark client = Ark( # The base URL for model invocation base_url='https://ark.cn-beijing.volces.com/api/v3', # Get API Key:https://console.volcengine.com/ark/region:ark+cn-beijing/apikey api_key=os.environ.get("ARK_API_KEY"), if __name__ == "__main__": print("----- create request -----") create_result = client.content_generation.tasks.create( model="doubao-seedance-2-0-260128", # Replace with Model ID content=[ "type": "text", "text": "将视频1礼盒中的香水替换成图片1中的面霜,运镜不变", "type": "image_url", "image_url": { "url": "https://ark-project.tos-cn-beijing.volces.com/doc_image/r2v_edit_pic1.jpg" "role": "reference_image", "type": "video_url", "video_url": { "url": "https://ark-project.tos-cn-beijing.volces.com/doc_video/r2v_edit_video1.mp4" "role": "reference_video", generate_audio=True, ratio="16:9", duration=5, watermark=True, print(create_result) # Polling query section print("----- polling task status -----") task_id = create_result.id while True: get_result = client.content_generation.tasks.get(task_id=task_id) status = get_result.status if status == "succeeded": print("----- task succeeded -----") print(get_result) break elif status == "failed": print("----- task failed -----") print(f"Error: {get_result.error}") break else: print(f"Current status: {status}, Retrying after 30 seconds...") time.sleep(30) 延长视频 在原有视频基础上,向前或者向后延长视频,或多个视频片段(最多 3 个视频片段)串联成一个连贯视频。 效果预览如下(访问 模型卡片 查看更多示例): 输入:文本 输入:待延长视频 输出 视频1中的拱形窗户打开,进入美术馆室内,接视频2,之后镜头进入画内,接视频3 00:00/00:00 2X快进中 重播 播放 00:00/00:00直播 00:00 00:00 进入全屏 1.5x 0.75x 0.5x 点击按住可拖动视频 00:00/00:00 2X快进中 重播 播放 00:00/00:00直播 00:00 00:00 进入全屏 1.5x 0.75x 0.5x 点击按住可拖动视频 00:00/00:00 2X快进中 重播 播放 00:00/00:00直播 00:00 00:00 进入全屏 1.5x 0.75x 0.5x 点击按住可拖动视频 00:00/00:00 2X快进中 重播 播放 00:00/00:00直播 00:00 00:00 进入全屏 1.5x 0.75x 0.5x 点击按住可拖动视频 Python Python import os import time # Install SDK: pip install 'volcengine-python-sdk[ark]' from volcenginesdkarkruntime import Ark client = Ark( # The base URL for model invocation base_url='https://ark.cn-beijing.volces.com/api/v3', # Get API Key:https://console.volcengine.com/ark/region:ark+cn-beijing/apikey api_key=os.environ.get("ARK_API_KEY"), if __name__ == "__main__": print("----- create request -----") create_result = client.content_generation.tasks.create( model="doubao-seedance-2-0-260128", # Replace with Model ID content=[ "type": "text", "text": "视频1中的拱形窗户打开,进入美术馆室内,接视频2,之后镜头进入画内,接视频3", "type": "video_url", "video_url": { "url": "https://ark-project.tos-cn-beijing.volces.com/doc_video/r2v_extend_video1.mp4" "role": "reference_video", "type": "video_url", "video_url": { "url": "https://ark-project.tos-cn-beijing.volces.com/doc_video/r2v_extend_video2.mp4" "role": "reference_video", "type": "video_url", "video_url": { "url": "https://ark-project.tos-cn-beijing.volces.com/doc_video/r2v_extend_video3.mp4" "role": "reference_video", generate_audio=True, ratio="16:9", duration=8, watermark=True, print(create_result) # Polling query section print("----- polling task status -----") task_id = create_result.id while True: get_result = client.content_generation.tasks.get(task_id=task_id) status = get_result.status if status == "succeeded": print("----- task succeeded -----") print(get_result) break elif status == "failed": print("----- task failed -----") print(f"Error: {get_result.error}") break else: print(f"Current status: {status}, Retrying after 30 seconds...") time.sleep(30) 说明 向前或向后延长 1 段视频,生成的视频一般只包含原视频的尾部画面。但您也可以通过提示词灵活控制,使其包含原视频内容。 例如:向前延长视频1,[延长内容描述...], 最后接视频1 传入 2~3 段视频,补全中间过渡部分,生成的视频会包含原视频内容和新生成的视频内容。 使用联网搜索 联网搜索能力仅适用于纯文本输入 Seedance 2.0 新增支持调用联网搜索工具,通过配置 tools. type 参数为 web_search 即可开启联网搜索。 开启联网搜索后,模型会根据用户的提示词自主判断是否搜索互联网内容(如商品、天气等)。可提升生成视频的时效性,但也会增加一定的时延。 实际搜索次数可通过 查询视频生成任务 API 返回的 usage.tool_usage. web_search 字段获取,如果为 0 表示未搜索。 输入:文本 输出 微距镜头对准叶片上翠绿的玻璃蛙。焦点逐渐从它光滑的皮肤,转移到它完全透明的腹部,一颗鲜红的心脏正在有力地、规律地收缩扩张。 说明 联网搜索玻璃蛙的容貌特征。 00:00/00:00 2X快进中 重播 播放 00:00/00:00直播 00:00 00:00 进入全屏 1.5x 0.75x 0.5x 点击按住可拖动视频 Curl 创建视频生成任务 Shell curl -X POST https://ark.cn-beijing.volces.com/api/v3/contents/generations/tasks \ -H "Content-Type: application/json" \ -H "Authorization: Bearer $ARK_API_KEY" \ -d '{ "model": "dou...