ElevenLabs 文本转对话 V3: AI 音频与音乐

使用 ElevenLabs V3 根据对话脚本生成富有表现力的多说话人音频。非常适合播客、有声书和互动语音应用。

📝

概览

关于此模型

ElevenLabs Text to Dialogue V3 可以根据结构化对话脚本生成自然且富有表现力的多说话人对话。每个说话人都可以分配独特的声音,从而生成适用于播客、有声书、互动小说和对话式 AI 应用的工作室级音频。模型支持多种语言,并提供稳定性控制,让你可以调整每个声音在较长会话中的一致性。

Text to Dialogue V3 基于 ElevenLabs 最新的 V3 合成引擎构建,无需后期处理即可生成逼真的语调和丰富的情绪变化。只需定义说话人、分配 voice ID 并提交请求,模型就会自动处理轮流发言、节奏和韵律。

1制作包含多位主持人的播客和广播节目
2使用不同角色声音进行有声书旁白
3生成互动小说和游戏对话
4制作客服演示对话和训练数据
5使用母语者声音制作语言学习材料
6制作包含多种说话人声音的自动视频旁白脚本
💰

价格与价值

成本分析

muapiapp$0.10 每次生成

muapiapp provides ElevenLabs Text to Dialogue V3 at a competitive flat rate with no per-character 收费, making it predictable and cost-effective for multi-turn dialogues.

ElevenLabs (direct)按字符计价(因情况而异)

ElevenLabs 收费 per character consumed. Longer dialogues can quickly exceed $0.10, making muapiapp the more economical choice for multi-speaker scripts.

** 竞品价格根据相似模型架构和使用层级估算。

⚙️

技术详情

配置参数

对话脚本array

说话人轮次列表。

默认值-
稳定性number

决定声音的稳定性和随机性(0 到 1,默认 0.5)。

默认值0.5
语言代码枚举(74 个选项)

对话的目标语言。留空则自动检测语言。

默认值null
📖

实施指南

开发者文档

如何使用 ElevenLabs Text to Dialogue V3

  1. 构建对话脚本

    • 构建 dialogue 数组:每个项目都是一个对象,包含说话人台词的 text 字段,以及该说话人 ElevenLabs 声音 ID 的 voice_id 字段。
    • 从内置列表中选择声音(例如 James、Arabella、Laura),或粘贴你自己的自定义 voice ID。
  2. 调整稳定性(可选)

    • 设置 stability(0.0–1.0,默认 0.5)来控制声音一致性。数值越高,声音越稳定;数值越低,表达变化越丰富。
  3. 设置语言(可选)

    • 使用 language_code(例如 enfrde)提示目标语言,从而改善发音。
  4. 提交请求

    • 将 JSON 发送到端点 api/v1/elevenlabs-text-to-dialogue-v3
  5. 获取音频

    • 响应中会包含生成音频文件的 URL。你可以直接下载或将其流式传输到应用中。

常见问题

常见问答

如何为不同说话人分配不同声音?

`dialogue` 数组中的每个项目都有一个 `voice_id` 字段。为每个说话人设置不同的 voice ID,即可让每个角色拥有独特声音。你可以从内置声音列表中选择,也可以提供自己的 ElevenLabs 自定义 voice ID。

Text to Dialogue V3 支持哪些语言?

模型支持包括英语、法语、德语、西班牙语、葡萄牙语、意大利语、波兰语等在内的多种语言。传入相应的 `language_code`(例如 `en`、`fr`),可以改善非英语脚本的准确性和发音。

`stability` 参数控制什么?

`stability`(0.0–1.0)控制每个声音在对话中的一致程度。接近 1.0 的值会让声音高度统一且可预测,而较低的值会带来更丰富的音高和表达变化。

一次对话可以包含多少个说话人?

说话人轮次没有硬性上限。你可以在一次请求中根据需要混合任意数量的说话人,只需为不同的对话项目分配不同的 voice ID。