Wan 2.7 Spicy 图生视频: 图像转视频

使用 Wan 2.7 Spicy 为图像制作动画。大胆、高对比度运动,支持可选音频引导生成、单镜头或多镜头构图。免费试用——按次生成付费。

📝

概览

关于此模型

Wan 2.7 Spicy 图生视频可将单张静态图像转换为大胆、高动态的视频片段,带来戏剧性的镜头运动和鲜明的高对比度调色。它支持可选的音频引导生成、单镜头或多镜头构图、自动提示词扩展以获得更丰富的运动细节,并支持以 720p 或 1080p 输出 5、10 或 15 秒片段。Spicy 版本针对比标准 Wan 2.7 图生视频 端点更强烈、更动态的输出进行了调校,同时保持相同的请求结构,因此两者之间切换只需修改一行。

1社交内容:将产品或生活方式照片制作成适合 Reels 和 TikTok 的吸睛高动态短片。
2音乐视觉:将音轨与静态图像结合,生成同步的高能量视频预告。
3广告创意:从单张主视觉图像生成大胆、高对比度的视频变体,用于 A/B 测试活动。
4故事板:在投入完整制作前,从单张参考帧预览多镜头序列。
💰

价格与价值

成本分析

muapiapp$1.00 – $4.50 每次生成

根据分辨率和时长定价:$1.00(5 秒/720p)至 $4.50(15 秒/1080p)。按次生成付费,无需订阅。

Fal.ai暂不可用

没有列出 Wan 2.7 Spicy 档位的图像转视频端点。

Replicate暂不可用

没有列出 Wan 2.7 Spicy 档位的图像转视频端点。

** 竞品价格根据相似模型架构和使用层级估算。

⚙️

技术详情

配置参数

图像 URLstring

要制作成视频的源图像

默认值undefined
提示词string

描述目标运动和场景的正向文本提示词

默认值undefined
负面提示词string

不希望生成的内容

默认值undefined
音频 URLstring

可选的 audio file to guide generation

默认值undefined
分辨率枚举(2 个选项)

输出视频分辨率

默认值720p
时长(秒)枚举(3 个选项)

Video duration (秒)

默认值5
镜头类型枚举(2 个选项)

单个连续镜头或多镜头序列

默认值single
启用提示词扩展boolean

自动扩展和优化提示词

默认值false
种子int

用于复现结果的随机种子(-1 表示随机)

默认值-1
📖

实施指南

开发者文档

如何使用 Wan 2.7 Spicy 图生视频

  1. 上传源图像:通过 image_url 提供高分辨率静态图像——这是唯一必填字段。

  2. 添加提示词(可选):描述想要的运动、镜头运动或场景;使用 negative_prompt 排除不需要的元素。

  3. 调整输出:选择 resolution720p1080p)、duration51015 秒)和 shot_typesingle 表示一个连续镜头,multi 表示多镜头序列)。

  4. 可选增强项:传入 audio_url 通过声音引导生成,设置 enable_prompt_expansion 让模型自动丰富提示词,或固定 seed 以获得可复现结果。

  5. 提交并轮询:调用下面的端点,然后轮询 GET /api/v1/predictions/{request_id}/result(或使用 webhook_url),直到 statuscompleted

curl -X POST https://api.muapi.ai/api/v1/wan2.7-image-to-video-spicy \
  -H "Authorization: Bearer $MUAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "image_url": "https://example.com/photo.jpg",
    "prompt": "戏剧性的缓慢变焦,伴随被风吹动的动态",
    "resolution": "1080p",
    "duration": 5,
    "shot_type": "single"
  }'

常见问题

常见问答

与标准 Wan 2.7 图生视频相比,"Spicy" 版本有什么变化?

Spicy 针对比标准端点更大胆、更高对比度、更具戏剧性的运动进行了调校。请求和响应结构相似,但 Spicy 增加了标准端点没有的 `shot_type`、`enable_prompt_expansion` 和 `seed` 控制项。

提示词是必填的吗?

不是——只有 `image_url` 是必填项。`prompt` 和 `negative_prompt` 都是可选的,可帮助你更精确地控制运动和场景。

支持哪些分辨率和时长?

支持 720p 和 1080p 分辨率,以及 5、10 或 15 秒的视频片段。价格会同时根据分辨率和时长变化。

可以用音频引导生成吗?

可以——传入 `audio_url` 后,模型会使用它来帮助控制生成视频的节奏和运动。

`shot_type` 用于什么?

`shot_type` 控制构图:`single` 生成一个连续镜头,`multi` 则根据同一张源图像生成多镜头序列。

如何获得一致且可复现的输出?

设置固定的整数 `seed`。保留默认值 `-1` 时,每次调用都会生成不同的随机结果。