什么是 Seedance 2.0 API?
Seedance 2.0 API 提供对 ByteDance Seed 多模态视频生成模型的编程访问,支持文本、图像、视频和音频输入,用于生成和基于参考的工作流。
高保真视频 · 最高支持 4k
Seedance 2.0 是字节跳动 Seed 团队推出的多模态 AI 视频生成模型,基于统一的音视频架构构建。它支持文本、图片、视频和音频输入,可用于视频生成、基于参考的创作、编辑与延展。
可用工作流:
Seedance 2.0 最多支持 12 个参考文件,其中图片最多 9 张、视频最多 3 段、音频最多 3 个。
| 模态 | 限制 | 格式 | 约束 |
|---|---|---|---|
| 图片 | 最多 9 张 | JPEG, PNG, WebP, GIF, BMP, TIFF, HEIC | 单个最大 30 MB;最短边 ≥ 400 px |
| 视频 | 最多 3 段 | MP4, MOV | 每个最大 50 MB;每个最长 15 秒;必须以素材形式上传 |
| 音频 | 最多 3 个 | MP3, WAV | 每个最大 15 MB;每个最长 15 秒;至少需要一张图片或一段视频 |
图片、视频、音频的参考素材总数不得超过 12 个。`audioUrls` 不能作为唯一参考 —— 至少需要一张图片或一段视频。
以下字段遵循 SeeGen AI 当前的 sd2 API 规范。resolution 控制宽高比/画幅,而 outputResolution 控制最终分辨率档位。
| 参数 | 类型 | 默认值 | 选项 / 说明 |
|---|---|---|---|
| prompt | string | — | 视频的文本描述。最多 20,000 字符。 |
| urls | string[] | — | 参考图片。支持 HTTP URL 和 asset:// 引用。参考模式下最多 9 张图片。 |
| videoUrls | string[] | — | 参考视频的 asset:// URI。最多 3 段视频;不支持外部视频 URL。 |
| audioUrls | string[] | — | 参考音频输入。最多 3 个音频文件;音频不能单独使用,至少需要一张图片或一段视频。 |
| videoInputMode | string | "keyframe" | 图像/首尾帧生成使用 "keyframe";多模态参考生成使用 "reference"。 |
| mode | string | — | 标准参考生成时省略;视频编辑使用 "edit",视频延展使用 "extend"。 |
| duration | string | "5s" | 输出时长范围为 "4s" 到 "15s"。 |
| resolution | string | "auto" | 宽高比:auto、720x720、720x960、960x720、1280x720、720x1280、1280x540。 |
| outputResolution | string | "720p" | 480p、720p、1080p、2k、4k。Seedance 2.0 Pro 原生输出 480p、720p、1080p 和 4K;2K 由 SeeGen AI 自动放大生成。 |
| generateAudio | boolean | true | 生成同步语音、音效和背景音乐。设为 false 可生成无声视频。 |
| bitrateMode | string | "standard" | "standard" 或 "high"。高码率能保留更多细节,但文件更大;价格不变。 |
| seed | integer | -1 | -1 或省略表示随机种子;0–2147483647 表示固定种子。 |
Seedance 2.0 Pro 原生输出 480p、720p、1080p 和 4K。2K 输出会自动放大生成。
Seedance 2.0 采用按量付费的积分定价。以下费率基于 500 美元 API 套餐:125,000 积分,每积分 0.004 美元。
| 条件 | 费率 | 10 秒片段 |
|---|---|---|
| SD2-Pro 480p,无视频输入 | 20 积分/秒(约 0.08 美元/秒) | 约 200 积分(约 0.80 美元) |
| SD2-Pro 480p,有视频输入 | 15 积分/秒(约 0.06 美元/秒) | 按输出 + 参考视频时长计算 |
| SD2-Pro 720p,无视频输入 | 40 积分/秒(约 0.16 美元/秒) | 约 400 积分(约 1.60 美元) |
| SD2-Pro 720p,有视频输入 | 30 积分/秒(约 0.12 美元/秒) | 按输出 + 参考视频时长计算 |
| SD2-Pro 1080p(原生),无视频输入 | 100 积分/秒(约 0.40 美元/秒) | 约 1,000 积分(约 4.00 美元) |
| SD2-Pro 1080p(原生),有视频输入 | 75 积分/秒(约 0.30 美元/秒) | 按输出 + 参考视频时长计算 |
| SD2-Pro 2K(放大生成),无视频输入 | 70 积分/秒(约 0.28 美元/秒) | 约 700 积分(约 2.80 美元) |
| SD2-Pro 2K(放大生成),有视频输入 | 30 × (出 + 入)+ 30 × 出 | 根据输出时长 + 参考视频时长计算 |
| SD2-Pro 4K(原生),无视频输入 | 200 积分/秒(约 $0.80/秒) | 约 2,000 积分(约 $8.00) |
| SD2-Pro 4K(原生),含视频输入 | 150 积分/秒(约 $0.60/秒) | 根据输出时长 + 参考视频时长计算 |
1. 无视频输入
credits = out × rate2. 含视频输入
credits = (out + in) × rateout = 输出秒数。in = 每个输入视频 ⌈时长⌉ 的总和。每个时长均向上取整,且最小输入时长为 ceil(out × 2 / 3)。 对于 2K 高清放大,额外的放大费率仅按输出时长计算。
分两步生成视频:先创建任务,再用返回的 taskId 查询结果。
请先上传参考图片、视频和音频文件作为素材。状态变为 ACTIVE 后,在生成请求中使用返回的 asset:// URI。
urlsvideoUrlsaudioUrls所有参考素材在使用前必须经过审核并处于 ACTIVE 状态。
curl -X POST https://seegen.ai/api/v1/jobs/createTask \
-H "Authorization: Bearer $SEEGEN_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "sd2",
"inputs": {
"urls": [
"asset://asset-reference-image"
],
"videoUrls": [
"asset://asset-reference-video"
],
"audioUrls": [
"asset://asset-reference-audio"
],
"prompt": "Create a cinematic scene using the provided character, motion, and audio references.",
"duration": "5s",
"videoInputMode": "reference",
"resolution": "1280x720",
"outputResolution": "720p",
"generateAudio": true
}
}'以上请求结构与 SeeGen 当前 Seedance 2.0 的多参考 API schema 一致。
使用返回的 taskId 查询任务状态。状态变为 COMPLETED 后,生成的视频将出现在 output[0].url 中。
curl \
-H "Authorization: Bearer $SEEGEN_API_KEY" \
"https://seegen.ai/api/v1/jobs/queryTask?taskId=YOUR_TASK_ID"任务完成后会返回 status: "COMPLETED",生成的视频链接位于 output[0].url。
| 应用场景 | 15 秒生成 | 多模态参考 | 视频编辑 | 原生音频 |
|---|---|---|---|---|
| 影视与娱乐 | 多镜头场景与短篇叙事序列 | 结合人物、环境、动作与风格参考 | 延展场景,或修改人物与动作 | 生成对白、音乐、环境音与音效 |
| 广告与电商 | 产品广告、品牌故事与社媒短视频 | 保持产品、模特、品牌形象与视觉风格一致 | 替换产品、标签、模特或场景细节 | 添加配音、产品音效与音乐 |
| 教育与知识 | 短篇讲解与可视化演示 | 结合图表、人物、场景与参考素材 | 优化讲解人、演示过程或视觉元素 | 生成旁白与同步音效 |
| 工业与企业 | 工作流程、培训与产品演示视频 | 保持设备、产品与环境的一致性 | 更新标签、规格或产品型号 | 添加操作讲解旁白与音效 |
| 游戏与虚拟内容 | CG 预告片、角色场景与剧集内容 | 组合虚拟角色、环境和动作参考 | 修改角色、风格和视觉细节 | 生成对话、音乐和游戏风格音效 |
| 特性 | Seedance 2.0 Pro | Seedance 2.0 Fast |
|---|---|---|
| 模型 ID | sd2 | sd2-fast |
| 最大时长 | 最长 15 秒 | 最长 15 秒 |
| 参考输入 | 最多 9 张图片 + 3 个视频 + 3 段音频 | 最多 9 张图片 + 3 个视频 + 3 段音频 |
| 原生分辨率 | 480p、720p、1080p、4K | 480p、720p |
| 更高分辨率 | 2K 超分 | 1080p、2K、4K 超分 |
| 480p,无视频输入 | 20 积分/秒 | 16 积分/秒 |
| 720p,无视频输入 | 40 积分/秒 | 32 积分/秒 |
| 5 秒 720p 示例 | 200 积分(约 $0.80) | 160 积分(约 $0.64) |
| 适用场景 | 原生高分辨率输出 | 更低成本的生成与迭代 |
需要原生 1080p 或 4K 输出时选择 Seedance 2.0 Pro;更看重生成成本时选择 Seedance 2.0 Fast。
Seedance 2.0 API 提供对 ByteDance Seed 多模态视频生成模型的编程访问,支持文本、图像、视频和音频输入,用于生成和基于参考的工作流。
是的。SeeGen AI 提供 Seedance 2.0 Pro(对应 sd2)、Seedance 2.0 Fast(对应 sd2-fast)和 Seedance 2.0 Mini(对应 sd2-mini)。
Seedance 2.0 支持 4 到 15 秒的输出时长,API 默认时长为 5 秒。
一个 Seedance 2.0 多参考任务最多可使用 9 张图片、3 个视频和 3 个音频文件,参考文件总数上限为 12 个。
不可以。在当前的 SeeGen Seedance 2.0 API 中,audioUrls 要求至少提供一个图片或视频参考。
SeeGen AI 支持 480p、720p、1080p、2k 和 4k。Seedance 2.0 Pro 原生输出 480p、720p、1080p 和 4K,而 2K 则会自动升频。
两者都支持 Seedance 2.0 的主要生成工作流。Pro 支持原生 1080p 和 4K 输出,而 Fast 原生生成 480p/720p,更高分辨率则通过自动升频实现。此外,Fast 在 480p 和 720p 下消耗的积分更少。
会。generateAudio 默认值为 true,会生成同步的语音、音效和背景音乐。如果需要无声输出,请将其设置为 false。
可以。真人图片和视频素材需要先通过官方素材审核,才能在 SeeGen AI 中作为参考使用。

新一代多模态参考 · 原生 1080p · 最高支持 4K

更快更便宜 · 原生 480p/720p

最低价档位 · 比 Pro 便宜 50% · 原生 480p/720p

原生音频 · 原生 720p/1080p

多档质量 · 最高支持 4K

生成迅速 · 最高支持 4K

最高画质 · 最高支持 4K

生成迅速 · 2K/4K

高保真 · 1K/2K