模型/音频/声音克隆
已上线MiniMax + Suno2 个模型

声音克隆 API — 为语音或音乐克隆声音

Muapi 声音克隆 API 通过统一 REST 流程,将短的参考录音转换为可复用的声音 ID。使用 MiniMax Voice Clone 创建可用于 MiniMax 文本转语音模型的说话声音,或使用 Suno Custom Voice Cloning 创建用于音乐生成的歌声。只需创建一次,之后即可在未来请求中复用该标识符。

已上线的声音克隆模型说话声音与歌声身份2 个模型
音频已上线
已上线

MiniMax Voice Clone

通过一次参考录音克隆说话声音,然后将可复用的声音 ID 交给 MiniMax Turbo 或 HD 语音模型。

Audio → voice ID
$0.65 / clone
试用模型
音频预览
已上线

Suno Custom Voice Cloning

通过带有新鲜活体短语的两次录音流程克隆歌声,再将得到的声音 persona 用于 Suno 音乐生成。

Audio → voice ID
Free preview
试用模型

什么是声音克隆 API?

声音克隆 API 会分析短音频样本并创建可复用的声音身份。无需每次重新上传参考录音,只需创建一次声音,然后在之后的语音或音乐生成请求中传入声音 ID。

Muapi 提供两种不同的克隆流程。MiniMax Voice Clone 为 MiniMax 文本转语音模型创建说话声音;Suno Custom Voice Cloning 为 Suno 音乐生成、混音和延展工作流创建歌声 persona。

两个流程都从音频 URL 开始,并使用 Muapi 的异步提交与轮询模式。Suno 还会要求第二次确认录音,因为说话人需要读出为该次克隆新生成的短语。

声音克隆 API 功能

说话声音克隆

MiniMax 根据参考录音复现语气、口音、节奏、情绪和说话风格。

可复用的 MiniMax 声音 ID

将克隆的 MiniMax 声音用于 speech-02-hd、speech-02-turbo、speech-2.5 或 speech-2.6 HD/Turbo 模型。

歌声 persona

Suno Custom Voice Cloning 捕捉歌声,用于音乐生成、混音和延展请求。

活体验证

Suno 会要求在样本之后朗读新生成的随机短语,帮助防止仅凭静态录音克隆声音。

输入清理控制

MiniMax 支持可选的降噪和音量标准化,帮助从不完美的录音中获得更干净的克隆。

命名自定义声音

为 MiniMax 设置 custom_voice_id,或为 Suno 设置 voice_name 和 style 元数据,让声音库更易管理。

声音克隆应用场景

个性化旁白

为产品视频、课程、播客和交互体验创建一致的声音。

角色与对白流程

在不同场景、语言和自动化文本转语音生成中复用同一个说话声音。

歌唱演示与音乐

为 Suno 歌曲、混音和延展编曲建立可复用的歌声音色 persona。

声音克隆模型对比

模型提供方价格适合场景
MiniMax Voice CloneMiniMax$0.65 / 次克隆文本转语音旁白与对白的说话声音
Suno Custom Voice CloningSuno预览期免费Suno 音乐生成的歌声 persona

声音克隆 API 代码示例

从参考音频 URL 开始,轮询返回的请求 ID,并按照模型专属流程完成请求。Suno 会在活体短语之后要求确认录音。

1. 使用 MiniMax 克隆说话声音

curl -X POST https://api.muapi.ai/api/v1/minimax-voice-clone -H "x-api-key: YOUR_API_KEY" -H "Content-Type: application/json" -d '{"audio_url":"https://example.com/voice-sample.wav","custom_voice_id":"myvoice001","model":"speech-02-hd","need_noise_reduction":true,"need_volume_normalization":true,"accuracy":0.7,"prompt":"Welcome to Muapi."}'

# Response: {"request_id":"REQUEST_ID"}
curl https://api.muapi.ai/api/v1/predictions/REQUEST_ID/result -H "x-api-key: YOUR_API_KEY"

发送参考音频 URL 和 custom_voice_id。示例请求还展示了可选的降噪、标准化、准确度、模型和预览提示词字段。

2. 使用 Suno 克隆歌声

curl -X POST https://api.muapi.ai/api/v1/suno-voice-clone -H "x-api-key: YOUR_API_KEY" -H "Content-Type: application/json" -d '{"audio_url":"https://example.com/singing-sample.wav","voice_name":"My Voice","language":"en","style":"Pop, Female Vocal"}'

# Poll until stage is "awaiting_phrase", then read the returned phrase aloud.
curl -X POST https://api.muapi.ai/api/v1/suno-voice-clone/REQUEST_ID/confirm -H "x-api-key: YOUR_API_KEY" -H "Content-Type: application/json" -d '{"audio_url":"https://example.com/verification-phrase.wav"}'

# Poll /predictions/REQUEST_ID/result again until voice_id is available.

先提交样本,在 awaiting_phrase 阶段朗读返回的新鲜短语,用第二段录音确认,然后继续轮询直到 voice_id 可用。

声音克隆 API 常见问题

什么是声音克隆 API?

声音克隆 API 将短参考录音转换为可复用的声音 ID。MiniMax Voice Clone 适合说话声音,Suno Custom Voice Cloning 适合用于音乐生成的歌声。

MiniMax 克隆的声音可以用于所有 MiniMax 语音模型吗?

可以。MiniMax 声音 ID 可用于 Turbo 和 HD 语音模型,包括 speech-02-hd、speech-02-turbo、speech-2.5 HD/Turbo 以及 speech-2.6 HD/Turbo。

Suno 为什么要求第二次录音?

Suno 会在初始样本之后生成新短语。说话人必须朗读并提交该短语作为确认,这项活体检查可以避免仅凭静态录音克隆声音。

声音克隆的价格是多少?

MiniMax Voice Clone 每次克隆 $0.65。Suno Custom Voice Cloning 在预览期间免费,未来可能改为付费。

可以克隆歌声而不是说话声音吗?

可以。使用 Suno Custom Voice Cloning 创建歌声 persona,并将其传入支持的 Suno 音乐生成、混音和延展请求。

应该使用什么样的录音?

请使用目标说话人声音清晰、背景噪声尽可能少的录音。Suno 的初始样本设计为约 10 秒,之后还要录制系统生成的验证短语。

如何获得声音克隆 API 访问权限?

创建 Muapi 账户,从控制面板生成 API 密钥,然后调用 MiniMax 或 Suno 声音克隆端点,无需等待名单。

准备好创建可复用的声音了吗?

创建一个 API 密钥,选择 MiniMax 用于说话声音,或选择 Suno 用于歌声。