ElevenLabs Text-to-Dialogue v3 API 是什么?
这是由 ElevenLabs Eleven v3 驱动、通过 AI Video API 提供的多角色文本转语音 API。你传入一组有序的对话轮次,每轮指定各自的声音,即可得到一段渲染完整对话的托管音频。生成为异步,支持回调或轮询。
把对话脚本变成自然的多声音音频。
ElevenLabs Text-to-Dialogue v3 API 把一组对话轮次(每轮指定各自的声音)合成为一段富有表现力的音频。专为对话场景设计,在 70+ 种语言中还原情感、节奏与你来我往的对话感。
模型能力
ElevenLabs Text-to-Dialogue v3 与你接入的其他视频和图片模型共用同一套 API Key、积分、日志、Webhook 和文档体系。
为每个对话轮次分配不同的 ElevenLabs 声音,打造可信的多角色对话。
Eleven v3 还原情感、重音与自然的轮替,呈现生动的你来我往对话。
可自动检测或指定语言,覆盖 70+ 种语言,全程保持声音一致。
通过 stability 参数在一致性与表现力变化之间取得平衡。
向音频端点发送 { text, voice } 的 dialogue 数组,以及可选的 stability、language_code 和回调地址。
用返回的任务 ID 轮询状态,或通过回调接收完成与失败事件。
任务完成后,通过与其他模型一致的响应结构返回镜像后的音频 URL。
curl -X POST https://api.aivideoapi.ai/v1/audio/generations \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "elevenlabs-text-to-dialogue-v3",
"input": {
"dialogue": [
{ "text": "Hey! Did you finish the report?", "voice": "EkK5I93UQWFDigLMpZcX" },
{ "text": "Almost — just adding the final numbers.", "voice": "Z3R5wn05IrDiVCyEkUrK" }
],
"stability": 0.5,
"language_code": "auto"
}
}'常见问题
这是由 ElevenLabs Eleven v3 驱动、通过 AI Video API 提供的多角色文本转语音 API。你传入一组有序的对话轮次,每轮指定各自的声音,即可得到一段渲染完整对话的托管音频。生成为异步,支持回调或轮询。
按字符计费,依据一次请求中所有对话文本的总长度。打开 playground 可查看精确的每字符积分单价和实时费用预估。提交时预扣积分,生成失败自动退款。
单次请求最多支持 10 个不同声音,所有对话轮次合计最多 5000 字符。每个轮次指定各自的 ElevenLabs voice ID 或预设名。
Eleven v3 支持 70+ 种语言。将 language_code 设为 auto 自动检测,或指定具体代码如 en、zh、ja、fr。
定价与用量
按对话总字符数计费
不同 voice ID
所有轮次合计
一个 API Key、一份积分余额,在视频和图片模型之间无缝切换,无需为每家供应商单独接入。