支持哪些输入?
支持文本,以及 first_and_last_frames 模式下的一至两张 HTTP(S) 图片。文生模式忽略 image_urls。不支持多模态参考、视频输入、音频输入、2K 输出和水印设置。
通过文本和可控首尾帧,生成 480p 或 768p 视频。
MiniMax H3 Max Turbo 根据提示词或一至两张帧图片生成 5–15 秒视频。可设置提示词扩写和可选种子,通过统一任务接口获取成片。积分由请求的输出秒数和分辨率决定,输入图片和提示词扩写免费。
模型能力
MiniMax H3 Max Turbo 与你接入的其他视频和图片模型共用同一套 API Key、积分、日志、Webhook 和文档体系。
省略 generation_type 即可根据提示词生成。支持 21:9、16:9、4:3、1:1、3:4 和 9:16 六种比例,默认 16:9。
使用 first_and_last_frames,一张公网图片控制首帧,两张图片控制首帧和尾帧;输出比例自动跟随图片。
扩写模式可选 disabled、balanced 或 quality,默认 balanced。可选种子为 1 至 4294967295 的整数。
480p 每秒 6.54 积分,768p 每秒 10 积分,按请求秒数计费。输入图片和提示词扩写免费,基础费用会应用账户倍率。
提示词最长 7,000 字符。文生视频省略 generation_type;首尾帧则设置 first_and_last_frames 并提供一至两个公网 HTTP(S) 图片 URL。
时长选择 5–15 秒整数,分辨率选择 480p 或 768p,并设置提示词扩写模式。默认 5 秒、768p 和 balanced 扩写。
使用 POST /v1/estimate 预览费用,再向 POST /v1/videos/generations 提交。通过任务 ID 轮询或接收回调,从 output.urls 获取视频。
curl -X POST https://api.aivideoapi.ai/v1/videos/generations \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-h3-max-turbo",
"input": {
"prompt": "A cinematic tracking shot through a rain-lit night market",
"resolution": "768p",
"duration": 5,
"aspect_ratio": "16:9",
"prompt_expansion_mode": "balanced",
"seed": 123456
}
}'常见问题
支持文本,以及 first_and_last_frames 模式下的一至两张 HTTP(S) 图片。文生模式忽略 image_urls。不支持多模态参考、视频输入、音频输入、2K 输出和水印设置。
仅接受 5 至 15 秒的整数,默认 5 秒。非法时长会在扣除积分前被拒绝。
请求秒数乘以对应分辨率单价,整单基础费用保留两位小数,再应用账户倍率并再次保留两位。480p、7 秒、账户倍率 1.1 时为 50.36 积分。返回的媒体用量不会追加费用。
确认失败的任务仅退款一次。提交结果不确定时保留预扣积分等待核对;生成成功后如视频交付需要重试,保留预扣积分并继续交付。已提交任务不支持取消。
定价与用量
账户倍率前,5 秒 32.70 积分,15 秒 98.10 积分
默认分辨率;账户倍率前,5 秒 50 积分,15 秒 150 积分
文生、首帧和首尾帧使用相同输出单价
一个 API Key、一份积分余额,在视频和图片模型之间无缝切换,无需为每家供应商单独接入。