新一代多模态视频生成 API

Seedance 2.5 API

通过文本、首尾帧、图片、视频或音频参考生成最长 30 秒视频。

Seedance 2.5 将多模态视频生成扩展到 4–30 秒输出,固定时长请求最多支持 30 张图片、10 个视频和 10 段音频,并支持纯音频输入;duration=-1 的视频数量和组合交由上游校验。通过同一套异步 API 完成文生视频、参考生视频、首尾帧控制、同步音频、MP4/MOV 输出、回调和任务轮询。

在线体验
4–30 秒 / -1
输出时长
480p / 720p / 1080p
分辨率
30 图 + 10 音频 + 上游校验视频
参考容量
ByteDance
doubao-seedance-2.5异步任务
4–30 秒 / -1
输出时长
480p / 720p / 1080p
分辨率
30 图 + 10 音频 + 上游校验视频
参考容量

模型能力

为生产级 API 工作流设计,不只是演示。

Seedance 2.5 与你接入的其他视频和图片模型共用同一套 API Key、积分、日志、Webhook 和文档体系。

高容量多模态参考

固定时长请求可组合最多 30 张图片、10 个视频和 10 段音频;duration=-1 的视频数量与组合由上游校验。

纯音频生成视频

无需搭配图片或视频即可使用音乐、人声或音效参考,让 Seedance 2.5 围绕声音意图构建视觉序列。

首帧与首尾帧控制

使用一张图片控制首帧,或使用两张图片分别控制首尾帧。专用帧模式采用 adaptive 比例并保持目标转场边界。

更长视频与同步音频

生成 4–30 秒视频并默认开启同步音频,为广告、叙事和连续镜头提供比上一代 15 秒工作流更充足的表达空间。

MP4、MOV 与尾帧复用

支持 MP4 或 MOV 输出,并可返回生成视频的尾帧,方便继续生成后续场景或接入剪辑流程。

生产级异步 API

通过统一视频端点提交任务并立即获得任务 ID,随后使用轮询或回调 URL 接收标准化的完成或失败结果。

API 工作流

提交任务、跟踪进度、取回生成结果。

01

选择生成模式

使用 omni_reference 处理文本或任意受支持的媒体组合,包括纯音频;使用 first_and_last_frames 配合一至两张图片控制首尾帧。

02

配置输出

选择 4–30 秒时长,或使用 duration=-1(可包含或不包含视频输入)让上游确定输出时长;同时配置 480p/720p/1080p、画面比例、同步音频、水印、MP4/MOV 及是否返回尾帧。

03

提交异步任务

向统一视频生成端点 POST 请求并指定 doubao-seedance-2.5。平台会在扣费前探测参考视频时长并选择正确费率。

04

轮询或接收回调

查询 GET /v1/tasks/{taskId} 或提供 callback_url。完成任务会通过标准响应返回托管视频 URL 和可选尾帧 URL。

POST /v1/videos/generations
curl -X POST https://api.aivideoapi.ai/v1/videos/generations \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedance-2.5",
    "callback_url": "https://your-server.com/webhooks/video",
    "input": {
      "prompt": "Keep the character design, follow the reference camera rhythm, and use the audio for ambience",
      "image_urls": ["https://example.com/character.png"],
      "video_urls": ["https://example.com/camera-reference.mov"],
      "audio_urls": ["https://example.com/ambience.wav"],
      "duration": 10,
      "resolution": "720p",
      "aspect_ratio": "adaptive",
      "generate_audio": true,
      "output_format": "mp4"
    }
  }'
典型应用场景
30 秒广告与宣传片
音频驱动的视觉序列
首尾帧转场
角色与产品一致性
参考动作与镜头迁移
音乐与氛围驱动叙事
故事板与概念开发
连续场景生成

为什么选择 Seedance 2.5

开发者关心的 Seedance 2.5 API 优势。

一个请求承载更多上下文

更高的图片、视频和音频数量上限,让应用可以表达复杂创意方向,无需把同一场景拆成多个生成任务。

由音频启动创作流程

Seedance 2.5 支持纯音频输入,可直接以音乐、人声或音效作为生成视频的起点。

参考视频计费透明

平台在创建任务前探测参考视频时长;包含视频时,输入秒数和输出秒数统一使用更低的视频参考费率。

常见问题

关于 Seedance 2.5 API 的常见问题解答。

什么是 Seedance 2.5 API?

Seedance 2.5 API 是 AI Video API 对字节跳动多模态视频模型的异步接入。使用 doubao-seedance-2.5 模型,可通过文本、图片、视频或音频输入生成 4–30 秒 480p/720p/1080p 视频。

Seedance 2.5 支持哪些生成模式?

omni_reference 支持文生视频及任意受支持的图片、视频、音频组合,音频可以单独使用。first_and_last_frames 使用一张图片控制首帧或两张图片控制首尾帧,不能同时包含视频或音频参考。

Seedance 2.5 最多支持多少参考素材?

单次请求最多支持 30 张图片、10 个总时长不超过 30 秒的视频,以及 10 段总时长不超过 30 秒的音频。首尾帧模式只接受一至两张图片。

Seedance 2.5 可以只根据音频生成视频吗?

可以。在 omni_reference 模式下,audio_urls 可以是唯一媒体输入,并且可以不传 prompt。模型会以音乐、人声或音效作为视觉序列的创作依据。

Seedance 2.5 如何计费?

不含视频输入时,480p 每输出秒 25.86 积分,720p 每输出秒 58.17 积分,1080p 每输出秒 103.68 积分。包含视频输入时,480p 每计费秒 17.24 积分,720p 每计费秒 38.78 积分,1080p 每计费秒 69.12 积分;duration=-1 不含视频时按实际输出时长计费,含视频时按输入视频总时长加实际输出时长计费。

Seedance 2.5 支持哪些输出格式?

支持 MP4 与 MOV。还可以将 return_last_frame 设为 true,返回视频尾帧用于连续生成或后期编辑。

提交 Seedance 2.5 请求后会发生什么?

API 会校验输入、按需探测参考视频时长、预扣计算出的积分并返回任务 ID。随后可轮询任务或使用 callback_url。确认失败或过期的任务会全额退款,成功任务保留最终扣费。

定价与用量

清晰的模型选项,共享积分余额。

480p 不含视频输入
25.86 积分/秒

仅按输出时长计费

480p 含视频输入
17.24 积分/秒

输入视频与输出时长合计

720p 不含视频输入
58.17 积分/秒

默认分辨率;仅按输出时长计费

720p 含视频输入
38.78 积分/秒

输入视频与输出时长合计

1080p 不含视频输入
103.68 积分/秒

仅按输出时长计费

1080p 含视频输入
69.12 积分/秒

输入视频与输出时长合计

在 AI Video API 上开始使用 Seedance 2.5。

一个 API Key、一份积分余额,在视频和图片模型之间无缝切换,无需为每家供应商单独接入。

阅读文档