关于此模型
MiniMax H3 Open Weights 参考素材生视频 LoRA 可根据文本提示词和多模态参考输入(最多 9 张图像、3 个视频、3 个音频)生成连贯的 480P 或 768P 视频,并生成原生立体声音频。它支持自定义 LoRA 微调,用于风格一致性、角色保持和创意控制。
成本分析
| 提供商 | 费用 | 备注 |
|---|---|---|
| muapiapp | $0.03 - $0.06 /秒 | 按生成视频的秒数计费,无需订阅。 |
| Fal.ai | 暂不可用 | 暂不支持自定义 LoRA。 |
| Replicate | 暂不可用 | 未托管此模型变体。 |
按生成视频的秒数计费,无需订阅。
暂不支持自定义 LoRA。
未托管此模型变体。
** 竞品价格根据相似模型架构和使用层级估算。
配置参数
| 参数 | 类型 | 描述 | 默认值 |
|---|---|---|---|
| 提示词 | string | 所需视频的文本描述。请按 <Picture 1..9>、<Video 1..3> 和 <Audio 1..3> 引用参考输入。 | A cinematic ocean wave at sunrise with <Picture 1> character walking, highly detailed |
| 参考图像 URL | array | 参考图像 URL(最多 9 个)。 | undefined |
| 参考视频 URL | array | Reference video URLs (up to 3). Total reference video duration is budgeted to 15 秒。 | undefined |
| 参考音频 URL | array | Standalone 参考音频 URLs (up to 3, trimmed to 15s each). | undefined |
| LoRA 列表 | array | 要应用的 LoRA 列表(最多 3 个)。 | - |
| 画面比例 | 枚举(7 个选项) | 输出视频的画面比例。 | 16:9 |
| 分辨率 | 枚举(2 个选项) | 输出视频分辨率。768p 为原生画布,480p 速度更快。 | 480p |
| 时长(秒) | int | Output video duration (秒). | 5 |
| 种子 | int | 随机种子(-1 表示随机) | -1 |
所需视频的文本描述。请按 <Picture 1..9>、<Video 1..3> 和 <Audio 1..3> 引用参考输入。
A cinematic ocean wave at sunrise with <Picture 1> character walking, highly detailed参考图像 URL(最多 9 个)。
undefinedReference video URLs (up to 3). Total reference video duration is budgeted to 15 秒。
undefinedStandalone 参考音频 URLs (up to 3, trimmed to 15s each).
undefined要应用的 LoRA 列表(最多 3 个)。
-输出视频的画面比例。
16:9输出视频分辨率。768p 为原生画布,480p 速度更快。
480pOutput video duration (秒).
5随机种子(-1 表示随机)
-1开发者文档
构思提示词和参考素材:编写文本提示词,引用 <Picture 1..9>、<Video 1..3> 或 <Audio 1..3>,并提供参考媒体 URL(images_list、videos_list、audios_list)。
配置画面比例和分辨率:选择画面比例(16:9、9:16、1:1 等)和输出分辨率(480p 或 768p)。
设置 LoRA 和时长:在 loras 中提供最多 3 个自定义 LoRA 对象,并选择 3 到 15 秒的时长。
提交请求:向 /api/v1/minimax-h3-reference-to-video-lora 发送 POST 请求:
curl -X POST https://api.muapi.ai/api/v1/minimax-h3-reference-to-video-lora \
-H 'Authorization: Bearer YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"prompt": "A cinematic ocean wave at sunrise with <Picture 1> character, highly detailed",
"images_list": ["https://example.com/character.jpg"],
"resolution": "480p",
"duration": 5
}'
常见问答
这是一个基于 MiniMax H3 Open Weights 构建的多模态参考素材生视频 AI 模型,支持自定义 LoRA 适配器和原生音频生成。
单个请求最多可以提供 9 张参考图像、3 个参考视频和 3 个参考音频。
会。模型会根据你的提示词和音频参考素材,在生成视频的同时自动合成同步的原生立体声音频。
你可以在 JSON 请求载荷的 `loras` 字段下传入 LoRA 对象数组。
根据输出视频时长(秒)和所选分辨率(480p 或 768p)计费。