Seedance 2 全能参考 VIP 1080p: 图像转视频

ByteDance 的 SD 2 全能参考 VIP 1080p。通过优先路由,使用最多 9 个图像参考、最多 3 个视频片段和最多 3 个音频参考生成全高清视频。在提示词中使用 @image1…@image9、@video1…@video3 和 @audio1…@audio3 引用参考素材。

📝

概览

关于此模型

更新于 2026年7月16日

Seedance 2 全能参考 VIP 1080p 是一款多模态视频生成模型,允许你在单次生成中组合最多 9 张图像、3 个视频片段和 3 个音频文件作为参考。你不必只为一张图像制作动画,而是可以编写丰富的提示词,使用 @image1 到 @image9、@video1 到 @video3 以及 @audio1 到 @audio3 的标记来引用这些素材。模型会综合所有输入,生成一段连贯的 1080p 视频,并遵循你提供的视觉和音频特征,在 4 到 15 秒内实现原生视听同步。

这是复杂创意项目的首选:编辑现有素材并加入视觉参考、叠加多条音轨,或融合来自多个来源的风格参考。通过 muapi 统一 API 使用,无需订阅,只在生成时付费。

1融合多个图像参考,创建兼顾所有视觉风格的合成视频
2编辑现有视频片段,同时加入音轨和额外的视觉引导
3结合视觉参考、音轨和方向性提示词制作音乐视频
4制作叠加多种素材类型(产品图像、旁白、背景视频)的复杂营销内容
💰

价格与价值

成本分析

muapiapp$3.38 每次生成

Muapi 收费 a flat per-generation rate regardless of how many reference materials you include, making multi-modal video creation affordable and predictable.

** 竞品价格根据相似模型架构和使用层级估算。

⚙️

技术详情

配置参数

提示词string

Video description. Use @image1…@image9 to 参考图像, @video1…@video3 for videos, and @audio1…@audio3 for audio. Use @character:<request_id> for a Seedance 2 character sheet or @omni-character:<char_id> for a trained Kinovi character. Multiple characters are supported.

默认值@image1 is the main character. The person walks along a city street at sunset, cinematic lighting.
图像 URLarray

最多 9 个参考图像 URL(JPEG/PNG/WebP)。第 N 张图像对应提示词中的 @imageN。

默认值https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg
参考视频 URLarray

最多 3 个参考视频片段 URL(MP4,每个最长 15 秒)。第 N 个视频对应提示词中的 @videoN。

默认值undefined
参考音频 URLarray

最多 3 参考音频 files (MP3/WAV, total max 15s). Each Nth audio corresponds to @audioN in the prompt.

默认值undefined
画面比例枚举(6 个选项)

输出视频的画面比例。

默认值16:9
时长(秒)int

视频时长(秒)。

默认值5
高比特率boolean

启用高比特率模式以获得更好的画面保真度,但会生成更大的文件。

默认值false
📖

实施指南

开发者文档

  1. 上传参考素材:通过 images_list 上传图像文件(最多 9 个),通过 video_files 上传视频文件(最多 3 个),通过 audio_files 上传音频文件(最多 3 个)。
  2. 编写提示词,使用类似“@image1 中的产品平滑旋转,@audio1 作为旁白,@video1 作为背景运动”的标记引用各个文件。根据需要使用 @image1-@image9、@video1-@video3 和 @audio1-@audio3。
  3. 选择目标 aspect_ratio(例如,横屏使用“16:9”,竖屏使用“9:16”)。
  4. 使用 duration 参数将所需时长设为 4 到 15 秒。
  5. 提交请求——模型会将所有参考素材合成为一段视听同步良好的连贯 1080p 视频。

常见问题

常见问答

可以同时使用全部 9 张图像、3 个视频和 3 个音频片段吗?

可以同时提供所有素材,模型会根据提示词指令使用它们。不过,提示词的清晰度很重要——明确指出哪个参考应占主导地位或各个参考应如何互动,比没有清晰指导地提供参考素材能产生更好的结果。

如何在提示词中引用上传的文件?

图像使用 @image1 到 @image9 引用,视频使用 @video1 到 @video3 引用,音频片段使用 @audio1 到 @audio3 引用。例如:“@image1 是主图,@video1 提供背景运动,@audio1 是旁白。”只能引用实际上传的文件。

Seedance 2 全能参考 VIP 1080p 每次生成的费用是多少?

该模型每次生成收费 $3.38。尽管需要处理多种参考类型,价格仍然简单透明——无需订阅,也不会按参考素材数量额外收费,只需支付单次生成费用。