关于此模型
ElevenLabs Text to Dialogue V3 可以根据结构化对话脚本生成自然且富有表现力的多说话人对话。每个说话人都可以分配独特的声音,从而生成适用于播客、有声书、互动小说和对话式 AI 应用的工作室级音频。模型支持多种语言,并提供稳定性控制,让你可以调整每个声音在较长会话中的一致性。
Text to Dialogue V3 基于 ElevenLabs 最新的 V3 合成引擎构建,无需后期处理即可生成逼真的语调和丰富的情绪变化。只需定义说话人、分配 voice ID 并提交请求,模型就会自动处理轮流发言、节奏和韵律。
成本分析
| 提供商 | 费用 | 备注 |
|---|---|---|
| muapiapp | $0.10 每次生成 | muapiapp provides ElevenLabs Text to Dialogue V3 at a competitive flat rate with no per-character 收费, making it predictable and cost-effective for multi-turn dialogues. |
| ElevenLabs (direct) | 按字符计价(因情况而异) | ElevenLabs 收费 per character consumed. Longer dialogues can quickly exceed $0.10, making muapiapp the more economical choice for multi-speaker scripts. |
muapiapp provides ElevenLabs Text to Dialogue V3 at a competitive flat rate with no per-character 收费, making it predictable and cost-effective for multi-turn dialogues.
ElevenLabs 收费 per character consumed. Longer dialogues can quickly exceed $0.10, making muapiapp the more economical choice for multi-speaker scripts.
** 竞品价格根据相似模型架构和使用层级估算。
配置参数
| 参数 | 类型 | 描述 | 默认值 |
|---|---|---|---|
| 对话脚本 | array | 说话人轮次列表。 | - |
| 稳定性 | number | 决定声音的稳定性和随机性(0 到 1,默认 0.5)。 | 0.5 |
| 语言代码 | 枚举(74 个选项) | 对话的目标语言。留空则自动检测语言。 | null |
说话人轮次列表。
-决定声音的稳定性和随机性(0 到 1,默认 0.5)。
0.5对话的目标语言。留空则自动检测语言。
null开发者文档
构建对话脚本
dialogue 数组:每个项目都是一个对象,包含说话人台词的 text 字段,以及该说话人 ElevenLabs 声音 ID 的 voice_id 字段。调整稳定性(可选)
stability(0.0–1.0,默认 0.5)来控制声音一致性。数值越高,声音越稳定;数值越低,表达变化越丰富。设置语言(可选)
language_code(例如 en、fr、de)提示目标语言,从而改善发音。提交请求
api/v1/elevenlabs-text-to-dialogue-v3。获取音频
常见问答
`dialogue` 数组中的每个项目都有一个 `voice_id` 字段。为每个说话人设置不同的 voice ID,即可让每个角色拥有独特声音。你可以从内置声音列表中选择,也可以提供自己的 ElevenLabs 自定义 voice ID。
模型支持包括英语、法语、德语、西班牙语、葡萄牙语、意大利语、波兰语等在内的多种语言。传入相应的 `language_code`(例如 `en`、`fr`),可以改善非英语脚本的准确性和发音。
`stability`(0.0–1.0)控制每个声音在对话中的一致程度。接近 1.0 的值会让声音高度统一且可预测,而较低的值会带来更丰富的音高和表达变化。
说话人轮次没有硬性上限。你可以在一次请求中根据需要混合任意数量的说话人,只需为不同的对话项目分配不同的 voice ID。