MiniMax Voice Clone
通过一次参考录音克隆说话声音,然后将可复用的声音 ID 交给 MiniMax Turbo 或 HD 语音模型。
Muapi 声音克隆 API 通过统一 REST 流程,将短的参考录音转换为可复用的声音 ID。使用 MiniMax Voice Clone 创建可用于 MiniMax 文本转语音模型的说话声音,或使用 Suno Custom Voice Cloning 创建用于音乐生成的歌声。只需创建一次,之后即可在未来请求中复用该标识符。
声音克隆 API 会分析短音频样本并创建可复用的声音身份。无需每次重新上传参考录音,只需创建一次声音,然后在之后的语音或音乐生成请求中传入声音 ID。
Muapi 提供两种不同的克隆流程。MiniMax Voice Clone 为 MiniMax 文本转语音模型创建说话声音;Suno Custom Voice Cloning 为 Suno 音乐生成、混音和延展工作流创建歌声 persona。
两个流程都从音频 URL 开始,并使用 Muapi 的异步提交与轮询模式。Suno 还会要求第二次确认录音,因为说话人需要读出为该次克隆新生成的短语。
MiniMax 根据参考录音复现语气、口音、节奏、情绪和说话风格。
将克隆的 MiniMax 声音用于 speech-02-hd、speech-02-turbo、speech-2.5 或 speech-2.6 HD/Turbo 模型。
Suno Custom Voice Cloning 捕捉歌声,用于音乐生成、混音和延展请求。
Suno 会要求在样本之后朗读新生成的随机短语,帮助防止仅凭静态录音克隆声音。
MiniMax 支持可选的降噪和音量标准化,帮助从不完美的录音中获得更干净的克隆。
为 MiniMax 设置 custom_voice_id,或为 Suno 设置 voice_name 和 style 元数据,让声音库更易管理。
为产品视频、课程、播客和交互体验创建一致的声音。
在不同场景、语言和自动化文本转语音生成中复用同一个说话声音。
为 Suno 歌曲、混音和延展编曲建立可复用的歌声音色 persona。
| 模型 | 提供方 | 价格 | 适合场景 |
|---|---|---|---|
| MiniMax Voice Clone | MiniMax | $0.65 / 次克隆 | 文本转语音旁白与对白的说话声音 |
| Suno Custom Voice Cloning | Suno | 预览期免费 | Suno 音乐生成的歌声 persona |
从参考音频 URL 开始,轮询返回的请求 ID,并按照模型专属流程完成请求。Suno 会在活体短语之后要求确认录音。
curl -X POST https://api.muapi.ai/api/v1/minimax-voice-clone -H "x-api-key: YOUR_API_KEY" -H "Content-Type: application/json" -d '{"audio_url":"https://example.com/voice-sample.wav","custom_voice_id":"myvoice001","model":"speech-02-hd","need_noise_reduction":true,"need_volume_normalization":true,"accuracy":0.7,"prompt":"Welcome to Muapi."}'
# Response: {"request_id":"REQUEST_ID"}
curl https://api.muapi.ai/api/v1/predictions/REQUEST_ID/result -H "x-api-key: YOUR_API_KEY"发送参考音频 URL 和 custom_voice_id。示例请求还展示了可选的降噪、标准化、准确度、模型和预览提示词字段。
curl -X POST https://api.muapi.ai/api/v1/suno-voice-clone -H "x-api-key: YOUR_API_KEY" -H "Content-Type: application/json" -d '{"audio_url":"https://example.com/singing-sample.wav","voice_name":"My Voice","language":"en","style":"Pop, Female Vocal"}'
# Poll until stage is "awaiting_phrase", then read the returned phrase aloud.
curl -X POST https://api.muapi.ai/api/v1/suno-voice-clone/REQUEST_ID/confirm -H "x-api-key: YOUR_API_KEY" -H "Content-Type: application/json" -d '{"audio_url":"https://example.com/verification-phrase.wav"}'
# Poll /predictions/REQUEST_ID/result again until voice_id is available.先提交样本,在 awaiting_phrase 阶段朗读返回的新鲜短语,用第二段录音确认,然后继续轮询直到 voice_id 可用。
声音克隆 API 将短参考录音转换为可复用的声音 ID。MiniMax Voice Clone 适合说话声音,Suno Custom Voice Cloning 适合用于音乐生成的歌声。
可以。MiniMax 声音 ID 可用于 Turbo 和 HD 语音模型,包括 speech-02-hd、speech-02-turbo、speech-2.5 HD/Turbo 以及 speech-2.6 HD/Turbo。
Suno 会在初始样本之后生成新短语。说话人必须朗读并提交该短语作为确认,这项活体检查可以避免仅凭静态录音克隆声音。
MiniMax Voice Clone 每次克隆 $0.65。Suno Custom Voice Cloning 在预览期间免费,未来可能改为付费。
可以。使用 Suno Custom Voice Cloning 创建歌声 persona,并将其传入支持的 Suno 音乐生成、混音和延展请求。
请使用目标说话人声音清晰、背景噪声尽可能少的录音。Suno 的初始样本设计为约 10 秒,之后还要录制系统生成的验证短语。
创建 Muapi 账户,从控制面板生成 API 密钥,然后调用 MiniMax 或 Suno 声音克隆端点,无需等待名单。
创建一个 API 密钥,选择 MiniMax 用于说话声音,或选择 Suno 用于歌声。