このモデルについて
Wan 3.0 参考素材转视频可根据文本プロンプト以及最多 10 张参考图像、5 个参考视频和 5 个参考音频生成视频,让角色、风格和声音在生成场景中保持一致。参考素材按照各数组中的排列顺序进行识别,因此プロンプト可以直接指代“第一张参考图像中的人物”或“参考视频中的人物”。你可以选择 480p、720p 或 1080p 出力、五种アスペクト比,以及 2 到 30 秒的时长;提供参考视频时,其总时长加上生成视频时长必须保持在 30 秒以内。如需不使用参考素材的普通テキストから動画生成,请参阅 Wan 3.0 テキストから動画生成;如需制作单张源图像的动画,请参阅 Wan 3.0 画像から動画生成。如需更高保真度的 Prime 档位,请参阅 Wan 3.0 Prime 参考素材转视频。如需相同请求结构下更大胆、对比度更高的版本,请参阅 Wan 3.0 Spicy 参考素材转视频。
コスト分析
| プロバイダー | 費用 | 備考 |
|---|---|---|
| muapiapp | From $0.10 per generation (720p, 2s) up to $6.00 (1080p, 30s) | 按次生成计费,根据分辨率和时长定价,サブスク不要。 |
| Fal.ai | 提供なし | 目前 Fal.ai 未列出 Wan 3.0。 |
| Replicate | 提供なし | 目前 Replicate 未列出 Wan 3.0。 |
按次生成计费,根据分辨率和时长定价,サブスク不要。
目前 Fal.ai 未列出 Wan 3.0。
目前 Replicate 未列出 Wan 3.0。
** 競合サービスの料金は類似のモデル構成および利用ティアに基づいて算出された推定値です。
設定スキーマ
| パラメータ | 型 | 説明 | デフォルト |
|---|---|---|---|
| プロンプト | string | 描述要创建的動画。参考媒体通过其数组顺序识别。 | The two people from the reference images meet on the rainy street shown in the reference video. |
| 参考画像 URL | array | Up to 10 reference images for visual coherence guidance. | undefined |
| 参考動画 URL | array | Up to 5 reference video clips (MP4/MOV, 1-15s each); total reference + generated duration must not exceed 30s. | undefined |
| 参考音声 URL | array | Up to 5 reference audio clips (total duration up to 15s) for soundtrack synchronization. | undefined |
| 解像度 | Enum(3個の選択肢) | 出力動画的解像度。 | 720p |
| アスペクト比 | Enum(5個の選択肢) | 出力動画的帧尺寸。 | 16:9 |
| 長さ(秒) | integer | 動画生成時間(秒)。 | 5 |
| 思考モード | boolean | 启用深度思考模式以理解复杂场景。 | false |
| 启用音声 | boolean | 在動画中加入生成的音声轨道。 | true |
| 种子 | integer | 用于复现结果的ランダムシード値。使用 -1 表示ランダムシード値。 | -1 |
描述要创建的動画。参考媒体通过其数组顺序识别。
The two people from the reference images meet on the rainy street shown in the reference video.Up to 10 reference images for visual coherence guidance.
undefinedUp to 5 reference video clips (MP4/MOV, 1-15s each); total reference + generated duration must not exceed 30s.
undefinedUp to 5 reference audio clips (total duration up to 15s) for soundtrack synchronization.
undefined出力動画的解像度。
720p出力動画的帧尺寸。
16:9動画生成時間(秒)。
5启用深度思考模式以理解复杂场景。
false在動画中加入生成的音声轨道。
true用于复现结果的ランダムシード値。使用 -1 表示ランダムシード値。
-1開発者ドキュメント
编写プロンプト:描述场景,并按照参考素材在数组中的顺序指代它们,例如“第一张参考图像中的人物”。
添加参考素材:在 images_list 中提供最多 10 个 URL,在 videos_list 中提供最多 5 个 URL,在 audios_list 中提供最多 5 个 URL。
设置出力画幅:选择 resolution(480p、720p、1080p)、aspect_ratio 和 duration(2–30 秒;如果提供参考视频,其时长加上出力时长必须不超过 30 秒)。
调整生成方式:为复杂的多参考场景启用 thinking_mode;如需无声视频,请将 enable_audio 设置为 false。
提交并轮询:使用 Muapi API 密钥发送请求,保存返回的 request_id,然后轮询预测结果端点,或提供 webhook_url。
curl -X POST https://api.muapi.ai/api/v1/wan3.0-reference-to-video \
-H "x-api-key: YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"prompt": "参考图像中的人物走进参考视频所展示的房间。",
"images_list": ["https://example.com/character.jpg"],
"videos_list": ["https://example.com/room.mp4"],
"resolution": "720p",
"duration": 5
}'
FAQ
它可根据プロンプト以及参考图像、视频和音频生成视频,让角色、风格和声音与所提供的参考素材保持一致。
每次请求最多可以发送 10 张参考图像、5 个参考视频和 5 个参考音频。
参考素材按照它们在各数组中的排列顺序进行识别,因此プロンプト可以指代“第一张参考图像”或类似的序数表达。
有。提供参考视频时,所有参考视频的总入力时长加上生成视频时长不得超过 30 秒。
支持 480p、720p 和 1080p,以及五种アスペクト比(16:9、9:16、1:1、4:3、3:4)。费用会随分辨率和时长变化,完成的任务响应中会包含该次生成的确切费用。