ElevenLabs TTS Turbo 2.5 文本转语音 API: AI 音频与音乐

使用 ElevenLabs TTS Turbo 2.5 将文本转换为语音。快速、自然的单音色旁白,支持可调稳定性和语速。免费试用——按次生成付费。

📝

概览

关于此模型

ElevenLabs TTS Turbo 2.5 可将书面文本转换为自然、富有表现力的单音色语音,在不牺牲音频质量的情况下优化生成速度。你可以从精选的内置音色中选择,也可以提供自己的 ElevenLabs 自定义音色 ID,然后微调稳定性、相似度和语速,以匹配项目的基调。

Turbo 2.5 专为高吞吐量旁白工作负载打造,非常适合配音、IVR 提示音,以及对处理速度有要求的应用生成音频。如果需要让多个不同角色进行多说话人对话,请改用 ElevenLabs Text to Dialogue V3

1配音:为视频、广告和社交内容快速生成旁白。
2IVR / 电话系统:为电话系统和语音助手生成提示音频。
3无障碍:将文章和文档转换为语音音频。
4应用音频:生成动态的应用内旁白、通知和提醒。
5电子学习:生成课程旁白和测验反馈音频。
6本地化:为全球受众生成受支持语言的语音。
💰

价格与价值

成本分析

muapiapp$0.05 每 1,000 个字符

Pay-per-use 定价 based on trimmed text length, 无需订阅 required.

Fal.ai暂不可用

Fal.ai 目前不提供 ElevenLabs TTS Turbo 2.5。

Replicate暂不可用

Replicate 目前不提供 ElevenLabs TTS Turbo 2.5。

** 竞品价格根据相似模型架构和使用层级估算。

⚙️

技术详情

配置参数

提示词string

要转换为语音的文本。最多 40,000 个字符;按裁剪后的长度计费。

默认值Welcome to Muapi. Your workspace is ready.
声音 ID枚举(26 个选项)

ElevenLabs 声音 ID。选择热门声音,或粘贴自定义声音 ID。

默认值21m00Tcm4TlvDq8ikWAM
稳定性number

决定声音的一致性和随机性(0 到 1,默认 0.5)。

默认值0.5
相似度增强number

决定输出与所选声音的相似程度(0 到 1,默认 0.75)。

默认值0.75
速度number

语速调整(0.7 到 1.2,默认 1.0)。

默认值1
语言代码枚举(7 个选项)

语音的目标语言。留空则自动检测语言。

默认值null
📖

实施指南

开发者文档

如何使用 ElevenLabs TTS Turbo 2.5

  1. 编写文本

    • 将要朗读的文本设置到 prompt(最多 40,000 个字符;计费基于裁剪后的长度)。
  2. 选择音色(可选)

    • voice_id 设置为内置音色之一,或设置为你自己的 ElevenLabs 自定义音色 ID。默认使用 Rachel。
  3. 调整表达(可选)

    • stability(0–1,默认 0.5):数值越高,音色越稳定;数值越低,表现变化越丰富。
    • similarity_boost(0–1,默认 0.75):输出与所选音色的匹配程度。
    • speed(0.7–1.2,默认 1.0):语速。
  4. 设置语言(可选)

    • 使用 language_code(例如 enfrdejavihuno)提示目标语言。
  5. 提交请求

curl -X POST https://api.muapi.ai/api/v1/elevenlabs-tts-turbo-2-5 \
  -H "x-api-key: YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "prompt": "Welcome to Muapi. Your workspace is ready.",
    "voice_id": "21m00Tcm4TlvDq8ikWAM",
    "speed": 1.0
  }'
  1. 获取音频
    • 轮询 /api/v1/predictions/{request_id}/result,直到状态为 completed,然后下载返回的音频 URL。

常见问题

常见问答

ElevenLabs TTS Turbo 2.5 可以做什么?

它使用 ElevenLabs 的 Turbo 2.5 合成引擎,将一段文本转换为自然的单音色语音,并针对快速处理进行了优化。

它与 Text to Dialogue V3 有什么不同?

Turbo 2.5 根据普通文本生成单音色旁白。Text to Dialogue V3 则根据结构化对话脚本生成多说话人对话,每轮使用不同音色。

如何选择音色?

将 `voice_id` 设置为内置音色选项之一,或粘贴自己的 ElevenLabs 自定义音色 ID。如果省略,模型默认使用 Rachel 音色。

`stability` 参数控制什么?

Stability(0–1)控制音色听起来有多一致。接近 1.0 的值会让表达统一且可预测;较低的值允许更自然、更有表现力的变化。

支持哪些语言?

Turbo 2.5 通过 `language_code` 参数支持英语、法语、德语、日语、越南语、匈牙利语和挪威语。留空则自动检测语言。

如何计算价格?

费用根据 `prompt` 文本裁剪后的字符数计算,按每 1,000 个字符计费。