一个请求承载更多上下文
更高的图片、视频和音频数量上限,让应用可以表达复杂创意方向,无需把同一场景拆成多个生成任务。
通过文本、首尾帧、图片、视频或音频参考生成最长 30 秒视频。
Seedance 2.5 将多模态视频生成扩展到 4–30 秒输出,固定时长请求最多支持 30 张图片、10 个视频和 10 段音频,并支持纯音频输入;duration=-1 的视频数量和组合交由上游校验。通过同一套异步 API 完成文生视频、参考生视频、首尾帧控制、同步音频、MP4/MOV 输出、回调和任务轮询。
模型能力
Seedance 2.5 与你接入的其他视频和图片模型共用同一套 API Key、积分、日志、Webhook 和文档体系。
固定时长请求可组合最多 30 张图片、10 个视频和 10 段音频;duration=-1 的视频数量与组合由上游校验。
无需搭配图片或视频即可使用音乐、人声或音效参考,让 Seedance 2.5 围绕声音意图构建视觉序列。
使用一张图片控制首帧,或使用两张图片分别控制首尾帧。专用帧模式采用 adaptive 比例并保持目标转场边界。
生成 4–30 秒视频并默认开启同步音频,为广告、叙事和连续镜头提供比上一代 15 秒工作流更充足的表达空间。
支持 MP4 或 MOV 输出,并可返回生成视频的尾帧,方便继续生成后续场景或接入剪辑流程。
通过统一视频端点提交任务并立即获得任务 ID,随后使用轮询或回调 URL 接收标准化的完成或失败结果。
使用 omni_reference 处理文本或任意受支持的媒体组合,包括纯音频;使用 first_and_last_frames 配合一至两张图片控制首尾帧。
选择 4–30 秒时长,或使用 duration=-1(可包含或不包含视频输入)让上游确定输出时长;同时配置 480p/720p/1080p、画面比例、同步音频、水印、MP4/MOV 及是否返回尾帧。
向统一视频生成端点 POST 请求并指定 doubao-seedance-2.5。平台会在扣费前探测参考视频时长并选择正确费率。
查询 GET /v1/tasks/{taskId} 或提供 callback_url。完成任务会通过标准响应返回托管视频 URL 和可选尾帧 URL。
curl -X POST https://api.aivideoapi.ai/v1/videos/generations \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seedance-2.5",
"callback_url": "https://your-server.com/webhooks/video",
"input": {
"prompt": "Keep the character design, follow the reference camera rhythm, and use the audio for ambience",
"image_urls": ["https://example.com/character.png"],
"video_urls": ["https://example.com/camera-reference.mov"],
"audio_urls": ["https://example.com/ambience.wav"],
"duration": 10,
"resolution": "720p",
"aspect_ratio": "adaptive",
"generate_audio": true,
"output_format": "mp4"
}
}'为什么选择 Seedance 2.5
更高的图片、视频和音频数量上限,让应用可以表达复杂创意方向,无需把同一场景拆成多个生成任务。
Seedance 2.5 支持纯音频输入,可直接以音乐、人声或音效作为生成视频的起点。
平台在创建任务前探测参考视频时长;包含视频时,输入秒数和输出秒数统一使用更低的视频参考费率。
常见问题
Seedance 2.5 API 是 AI Video API 对字节跳动多模态视频模型的异步接入。使用 doubao-seedance-2.5 模型,可通过文本、图片、视频或音频输入生成 4–30 秒 480p/720p/1080p 视频。
omni_reference 支持文生视频及任意受支持的图片、视频、音频组合,音频可以单独使用。first_and_last_frames 使用一张图片控制首帧或两张图片控制首尾帧,不能同时包含视频或音频参考。
单次请求最多支持 30 张图片、10 个总时长不超过 30 秒的视频,以及 10 段总时长不超过 30 秒的音频。首尾帧模式只接受一至两张图片。
可以。在 omni_reference 模式下,audio_urls 可以是唯一媒体输入,并且可以不传 prompt。模型会以音乐、人声或音效作为视觉序列的创作依据。
不含视频输入时,480p 每输出秒 25.86 积分,720p 每输出秒 58.17 积分,1080p 每输出秒 103.68 积分。包含视频输入时,480p 每计费秒 17.24 积分,720p 每计费秒 38.78 积分,1080p 每计费秒 69.12 积分;duration=-1 不含视频时按实际输出时长计费,含视频时按输入视频总时长加实际输出时长计费。
支持 MP4 与 MOV。还可以将 return_last_frame 设为 true,返回视频尾帧用于连续生成或后期编辑。
API 会校验输入、按需探测参考视频时长、预扣计算出的积分并返回任务 ID。随后可轮询任务或使用 callback_url。确认失败或过期的任务会全额退款,成功任务保留最终扣费。
定价与用量
仅按输出时长计费
输入视频与输出时长合计
默认分辨率;仅按输出时长计费
输入视频与输出时长合计
仅按输出时长计费
输入视频与输出时长合计
一个 API Key、一份积分余额,在视频和图片模型之间无缝切换,无需为每家供应商单独接入。