SH 与现有 MiniMax H3 模型有什么区别?
SH 是 Open Weights 版本,具有独立模型 ID、四档分辨率和独立价格。已有 minimax-h3、Fast、Max 和 Max Turbo 的参数及价格保持原样。
通过文本、首尾帧和多模态参考,生成原生有声视频。
MiniMax H3 SH 接入 Open Weights 版本,提供文生视频、图生视频和参考生视频三个独立模型。使用统一任务接口生成 3–15 秒视频,支持四档分辨率,原生立体声包含在生成价格内。
模型能力
MiniMax H3 SH 与你接入的其他视频和图片模型共用同一套 API Key、积分、日志、Webhook 和文档体系。
在提示词中描述画面、运动、镜头和声音,支持包括 21:9、9:21 在内的七种画面比例。
一张图片控制首帧,两张图片分别控制首帧和尾帧。图生视频比例跟随图片,首尾帧图片免费。
最多可提供 9 张图片、3 个视频和 3 段音频。参考视频共用 15 秒处理预算,独立音频每段最多使用 15 秒。
可选 480p、540p、原生 768p 或 1080p。所有模式包含原生立体声,默认生成 5 秒 480p 视频。
选择 minimax-h3-sh/text-to-video、minimax-h3-sh/image-to-video 或 minimax-h3-sh/reference-to-video,通过 image_urls、video_urls 和 audio_urls 传入支持的素材。
填写非空提示词,选择 3–15 秒整数时长和分辨率,可选设置种子。参考提示词使用 <Picture 1>、<Video 1> 和 <Audio 1> 标记指定素材。
使用 POST /v1/estimate 获取包含参考素材的完整价格,通过 /v1/videos/generations 提交,再轮询任务 ID 或接收回调,从 output.urls 获取视频。
curl -X POST https://api.aivideoapi.ai/v1/videos/generations \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-h3-sh/text-to-video",
"input": {
"prompt": "A slow tracking shot through a sunlit forest. Audio: birdsong and gentle wind.",
"resolution": "480p",
"duration": 5,
"aspect_ratio": "16:9"
}
}'常见问题
SH 是 Open Weights 版本,具有独立模型 ID、四档分辨率和独立价格。已有 minimax-h3、Fast、Max 和 Max Turbo 的参数及价格保持原样。
服务端探测每个视频,按实际秒数求和并保留小数,最多计费 15 秒。两个 5.167 秒参考视频共计 10.334 秒输入;搭配 5 秒 480p 输出时,账户倍率前费用为 153.34 积分。
输出按请求的整数秒数计费。模型帧网格可能让 5 秒请求得到约 5.2 秒成片,不会因此补扣积分。
参考生视频至少需要一种参考图片、视频或音频。每段独立音频为 4 积分,参考视频自带的音轨不会重复按独立音频计费。
确认失败的任务只退款一次。任务生成成功后,不会因为后续视频交付或回调需要重试而退款;最终状态以任务查询接口为准。
定价与用量
依次为 480p / 540p / 768p / 1080p;首尾帧图片免费
分辨率顺序相同;参考视频按实际秒数求和并保留小数,最多计费 15 秒
仅参考生模式按图片数或独立音轨数收费;生成的原生声音不另收费
一个 API Key、一份积分余额,在视频和图片模型之间无缝切换,无需为每家供应商单独接入。