MiniMax H3 参考素材生视频 LoRA: Lora Support

使用 MiniMax H3 参考素材生视频 LoRA 从多模态参考素材生成视频。支持自定义 LoRA、原生音频。免费试用。

📝

概要

このモデルについて

MiniMax H3 Open Weights 参考素材生视频 LoRA 可根据文本プロンプト和多模态参考入力(最多 9 张图像、3 个视频、3 个音频)生成连贯的 480P 或 768P 视频,并生成原生立体声音频。它支持自定义 LoRA 微调,用于风格一致性、角色保持和创意控制。

1多模态视频生成:将参考图像、参考视频片段和音频轨道与文本プロンプト结合。
2自定义 LoRA 适配:将自定义视觉风格或角色 LoRA 应用于多参考视频生成。
3原生立体声音频:在视觉视频元素旁原生生成同步的立体声音轨。
💰

料金と価値

コスト分析

muapiapp$0.03 - $0.06 / sec

生成動画の秒数に応じた従量課金制(サブスク不要)。

Fal.ai提供なし

カスタムLoRAには未対応。

Replicate提供なし

このモデルバリアントはホストされていません。

** 競合サービスの料金は類似のモデル構成および利用ティアに基づいて算出された推定値です。

⚙️

技術詳細

設定スキーマ

プロンプトstring

所需動画的文本描述。请按 <Picture 1..9>、<Video 1..3> 和 <Audio 1..3> 引用参考入力。

デフォルト値A cinematic ocean wave at sunrise with <Picture 1> character walking, highly detailed
参考画像 URLarray

参考画像 URL(最多 9 个)。

デフォルト値undefined
参考動画 URLarray

Reference video URLs (up to 3). Total reference video duration is budgeted to 15 seconds.

デフォルト値undefined
参考音声 URLarray

Standalone reference audio URLs (up to 3, trimmed to 15s each).

デフォルト値undefined
LoRA 列表array

要应用的 LoRA 列表(最多 3 个)。

デフォルト値-
アスペクト比Enum(7個の選択肢)

出力動画的アスペクト比。

デフォルト値16:9
解像度Enum(2個の選択肢)

出力動画解像度。768p 为原生画布,480p 速度更快。

デフォルト値480p
長さ(秒)(秒)int

Output video duration in seconds.

デフォルト値5
种子int

ランダムシード値(-1 表示随机)

デフォルト値-1
📖

実装ガイド

開発者ドキュメント

使用方法 MiniMax H3 参考素材生视频 LoRA

  1. 构思プロンプト和参考素材:编写文本プロンプト,引用 <Picture 1..9><Video 1..3><Audio 1..3>,并提供参考媒体 URL(images_listvideos_listaudios_list)。

  2. 配置アスペクト比和分辨率:选择アスペクト比(16:99:161:1 等)和出力分辨率(480p768p)。

  3. 设置 LoRA 和时长:在 loras 中提供最多 3 个自定义 LoRA 对象,并选择 3 到 15 秒的时长。

  4. リクエスト送信:向 /api/v1/minimax-h3-reference-to-video-lora 发送 POST 请求:

curl -X POST https://api.muapi.ai/api/v1/minimax-h3-reference-to-video-lora \
  -H 'Authorization: Bearer YOUR_API_KEY' \
  -H 'Content-Type: application/json' \
  -d '{
    "prompt": "A cinematic ocean wave at sunrise with <Picture 1> character, highly detailed",
    "images_list": ["https://example.com/character.jpg"],
    "resolution": "480p",
    "duration": 5
  }'

よくある質問

FAQ

MiniMax H3 参考素材生视频 LoRA 是什么?

这是一个基于 MiniMax H3 Open Weights 构建的多模态参考素材生视频 AI 模型,支持自定义 LoRA 适配器和原生音频生成。

可以提供多少个参考媒体文件?

单个请求最多可以提供 9 张参考图像、3 个参考视频和 3 个参考音频。

该模型会原生生成音频吗?

会。模型会根据你的プロンプト和音频参考素材,在生成视频的同时自动合成同步的原生立体声音频。

如何传入自定义 LoRA 适配器?

你可以在 JSON 请求载荷的 `loras` 字段下传入 LoRA 对象数组。

如何计算费用?

根据出力视频时长(秒)和所选分辨率(480p 或 768p)计费。