关于此模型
Wan 3.0 图生视频使用运动提示词为源图像制作动画,并在一次异步 Muapi 调用中生成带同步音频的视频。提供可选的 last_image 来引导镜头的结束方式,并可选择 480p、720p 或 1080p 输出、五种画面比例以及 2 到 30 秒的时长。thinking_mode 标志可帮助模型推理复杂的运动提示词,也可以关闭音频生成以获得无声片段。若要在没有源图像的情况下根据文本提示词生成场景,请参阅 Wan 3.0 文生视频;若要使用多张参考图像、视频和音频引导镜头,请参阅 Wan 3.0 参考素材转视频。如需更高保真度的 Prime 档位,请参阅 Wan 3.0 Prime 图生视频。如需相同请求形态下更大胆、对比度更高的版本,请参阅 Wan 3.0 Spicy 图生视频。
成本分析
| 提供商 | 费用 | 备注 |
|---|---|---|
| muapiapp | 起价 $0.10 每次生成 (720p, 2s) up to $6.00 (1080p, 30s) | 按次生成计费,根据分辨率和时长定价,无需订阅。 |
| Fal.ai | 暂不可用 | 目前 Fal.ai 未列出 Wan 3.0。 |
| Replicate | 暂不可用 | 目前 Replicate 未列出 Wan 3.0。 |
按次生成计费,根据分辨率和时长定价,无需订阅。
目前 Fal.ai 未列出 Wan 3.0。
目前 Replicate 未列出 Wan 3.0。
** 竞品价格根据相似模型架构和使用层级估算。
配置参数
| 参数 | 类型 | 描述 | 默认值 |
|---|---|---|---|
| 提示词 | string | 描述要创建的运动和场景。 | The camera slowly pushes in as a breeze moves through the subject's hair. |
| 图像 URL | string | 要制作动画的源图像。 | undefined |
| 末帧图像 URL | string | 可选的 end-frame image to guide how the video should end. | undefined |
| 分辨率 | 枚举(3 个选项) | 输出视频的分辨率。 | 720p |
| 画面比例 | 枚举(5 个选项) | 输出视频的帧尺寸。 | 16:9 |
| 时长 | integer | 视频时长(秒)。 | 5 |
| 思考模式 | boolean | 为复杂提示词启用深度思考模式。 | false |
| 启用音频 | boolean | 在视频中加入生成的音频轨道。 | true |
| 种子 | integer | 用于复现结果的随机种子。使用 -1 表示随机种子。 | -1 |
描述要创建的运动和场景。
The camera slowly pushes in as a breeze moves through the subject's hair.要制作动画的源图像。
undefined可选的 end-frame image to guide how the video should end.
undefined输出视频的分辨率。
720p输出视频的帧尺寸。
16:9视频时长(秒)。
5为复杂提示词启用深度思考模式。
false在视频中加入生成的音频轨道。
true用于复现结果的随机种子。使用 -1 表示随机种子。
-1开发者文档
提供源图像:通过 image_url 上传或链接起始帧。
描述运动:使用 prompt 描述所需的镜头运动和动作。
可选:引导结束画面:传入 last_image,将视频引导至指定的结束帧。
设置输出画幅:选择 resolution(480p、720p、1080p)、aspect_ratio 和 duration(2–30 秒),并按需切换 enable_audio 或 thinking_mode。
提交并轮询:使用 Muapi API 密钥发送请求,保存返回的 request_id,然后轮询预测结果端点,或提供 webhook_url。
curl -X POST https://api.muapi.ai/api/v1/wan3.0-image-to-video \
-H "x-api-key: YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"prompt": "镜头缓慢推进,微风吹动主体的头发。",
"image_url": "https://example.com/portrait.jpg",
"resolution": "720p",
"duration": 5
}'
常见问答
它可将源图像制作成带同步音频的视频,并通过运动提示词和可选的结束帧图像进行引导。
请发送描述运动的 `prompt`,以及指向源图像的 `image_url`。本地图像可以先通过 Muapi 的上传端点上传。
它是可选的结束帧图像,用于引导生成的视频以特定画面收尾。
支持 480p、720p 或 1080p 分辨率,五种画面比例(16:9、9:16、1:1、4:3、3:4),以及 2 到 30 秒的时长。默认生成音频;将 `enable_audio` 设置为 `false` 即可生成无声视频。
费用会随分辨率和时长变化,完成的任务响应中会包含该次生成的确切费用。