Seedance 2.5 Spicy 全能参考: 图像转视频

使用 Seedance 2.5 全能参考将图像、视频和音频融合成一个视频。720p、30 秒片段。可免费试用,按次生成付费,无需订阅。高强度(Spicy)端点,价格比标准档位高 10%。

教程

📝

概览

关于此模型

Seedance 2.5 全能参考是 Seedance 2.5 系列中的早期体验多参考端点,可将最多 30 张参考图像、10 个视频片段和 10 个音频文件融合为一次引导式视频生成。使用图像控制环境和风格,使用视频控制镜头运动和节奏,使用音频作为氛围参考——所有内容通过一个文本提示词组合。支持最长 30 秒、720p 的片段。这是 Muapi 同款 Seedance 2.5 模型的 Spicy 端点——标准档位的高强度兄弟版本,视觉风格更大胆、对比度更高。

1风格一致的内容:组合多张参考图像,锁定跨镜头一致的视觉风格。
2音乐驱动视频:使用音频片段作为生成运动的氛围和节奏参考。
3镜头运动迁移:参考现有视频片段,将其镜头运动带入新场景。
4多源合成:将环境图像、运动参考和音频氛围融合为一个连贯片段。
💰

价格与价值

成本分析

muapiapp$0.34/秒 (720p) or $0.17/秒 (480p)

不使用视频参考时仅按输出时长计费。使用视频参考时,参考视频与生成结果的合计时长按该费率的 65% 计费(720p 为 $0.221/秒,480p 为 $0.11/秒)。

Fal.ai$0.47/秒 (720p) or $0.2205/秒 (480p)

MuAPI 在 720p 比 Fal.ai 便宜约 28%,在 480p 便宜约 23%。

Replicate暂不可用

Replicate 未列出 Seedance 2.5。

** 竞品价格根据相似模型架构和使用层级估算。

⚙️

技术详情

配置参数

提示词string

描述目标视频的文本提示词,并将提供的图像、视频片段和音频作为环境、运动与情绪参考。

默认值Create a calm cinematic park sequence. Use the images for environment style, the video clips for camera motion and street rhythm, and the audio as mood reference.
参考图像array

参考图像 URL,最多 30 张。

默认值undefined
参考视频array

参考视频 URL,最多 10 个片段。

默认值undefined
参考音频array

参考音频 URL,最多 10 个文件。

默认值undefined
时长int

生成视频的时长(秒)。

默认值5
画面比例枚举(7 个选项)

输出视频的画面比例。

默认值16:9
全能参考任务类型枚举(4 个选项)

全能参考子任务类型提示,用于在提交时捕获比例/时长约束不匹配,而不是等到异步执行失败。auto 允许模型从提示词推断类型;reference 没有特殊的比例/时长约束;edit 和 extend 都要求 ratio=adaptive(edit 还要求 duration=-1)。模型在处理过程中仍会根据提示词重新推导实际任务类型,因此不匹配仍可能在异步处理中报错。

默认值auto
种子int

用于复现生成结果的随机种子。使用 -1 表示随机。

默认值42
高比特率boolean

启用高比特率模式以获得更好的画面保真度,但会生成更大的文件。

默认值false
📖

实施指南

开发者文档

如何使用 Seedance 2.5 全能参考

  1. 收集参考素材

    • 通过 images_list 提供最多 30 张图像,通过 videos_list 提供 10 个视频,通过 audios_list 提供 10 个音频文件。建议至少提供一个参考素材。
  2. 编写引导提示词

    • 描述这些参考素材应如何组合。
    • 示例:“创建一段平静的电影感公园片段。使用图像提供环境风格,使用视频片段提供镜头运动和街道节奏,使用音频作为氛围参考。”
  3. 配置输出

    • 设置 duration(4–30s)、aspect_ratio,并可选设置 seed
  4. 通过 API 提交

curl -X POST https://api.muapi.ai/api/v1/seedance-2.5-spicy-omni-reference \
  -H "x-api-key: YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "prompt": "Create a calm cinematic park sequence using the references for style, motion, and mood.",
    "images_list": ["https://example.com/ref1.jpg", "https://example.com/ref2.jpg"],
    "videos_list": ["https://example.com/ref.mp4"],
    "duration": 10
  }'
  1. 轮询并下载
    • 轮询 GET /api/v1/predictions/{request_id}/result,直到 statuscompleted,然后从 output 获取视频 URL。

常见问题

常见问答

Spicy 端点有什么不同?

请求/响应格式与标准端点相同,但它运行在高强度 Spicy 档位上,运动表现更戏剧化、对比度更高。价格比标准档位高 10%。

Seedance 2.5 全能参考能做什么?

它会结合参考图像、视频片段和音频文件来引导视频生成,将它们的风格、运动和氛围线索融合到一个输出中。

可以提供多少个参考素材?

最多 30 张图像、10 个视频片段和 10 个音频文件,分别通过 `images_list`、`videos_list` 和 `audios_list` 传入。

为什么它比普通文生视频/图生视频更贵?

全能参考使用与基础模型相同的每秒费率(720p 为 $0.34/sec,480p 为 $0.17/sec),但按视频总时长计费——包括生成输出以及你提供的每个参考视频——而不仅是输出时长。

它输出什么分辨率?

默认输出 720p。另有更便宜的 480p 版本。

生成视频最长多长?

4 到 30 秒,可通过 `duration` 参数配置。

是否必须提供三种参考素材?

不需要——图像、视频和音频可以任意组合。即使只提供文本提示词也能工作,但参考素材可以更精准地控制风格、运动和氛围。