Seedance 2 全能参考: 图像转视频

ByteDance 的 SD 2 全能参考。使用最多 9 个图像参考和最多 3 个音频参考生成视频。在提示词中使用 @image1、@image2 等引用图像,使用 @audio1、@audio2 等引用音频。

📝

概览

关于此模型

更新于 2026年7月16日

Seedance 2 全能参考是一款全面的多模态视频生成工具,可在单次生成中组合最多 9 个图像参考和最多 3 个音频参考。图像参考在提示词中标记为 @image1、@image2 等,音频文件标记为 @audio1、@audio2 等,让你能够精确控制哪些元素作为视频的锚点。它非常适合叙事驱动的制作、音乐视频、品牌内容,以及需要多个视觉和声音元素和谐共存的复杂视觉叙事。

非常适合需要复杂多元素协调的电影制作人、音乐视频导演、商业制片人和创作者。muapi 的统一 API 每次生成收费 $1.25,无需传统多轨制作工作流的复杂性,即可使用这项高级能力。

1制作与多条音轨同步、包含多样视觉元素和场景的音乐视频
2结合产品镜头、生活方式图像和旁白音频,生成品牌视频叙事
3制作交织角色参考、环境图像和背景音乐的动画序列
4构建具有协调视觉主题、多个人物和分层音景的复杂故事项目
💰

价格与价值

成本分析

muapiapp$1.25 每次生成

Single transparent price covers complex multi-element video coordination. 无需订阅 needed—pay only per video, making sophisticated reference-driven production accessible without expensive production software.

** 竞品价格根据相似模型架构和使用层级估算。

⚙️

技术详情

配置参数

提示词string

Video description. Use @image1…@image9 to 参考图像 and @audio1…@audio3 for audio. To use a character sheet, reference it with @character:<request_id> (from a completed Seedance 2 Character generation). To use a trained Omni Reference character, reference it with @omni-character:<character_id> where character_id is the value returned by Omni Reference Train Character (e.g. char_1775422630065_4vbana). Both methods can be combined in the same prompt. Multiple characters are supported. Example: '@omni-character:char_1775422630065_4vbana walking through a neon-lit city at night'.

默认值@image1 is the main character. The person walks along a city street at sunset, cinematic lighting.
图像 URLarray

最多 9 个参考图像 URL(JPEG/PNG/WebP)。第 N 张图像对应提示词中的 @imageN。

默认值https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg
参考音频 URLarray

最多 3 参考音频 files (MP3/WAV, total max 15s). Each Nth audio corresponds to @audioN in the prompt.

默认值undefined
画面比例枚举(4 个选项)

输出视频的画面比例。

默认值16:9
时长(秒)int

Video duration (秒) (4–15).

默认值5
📖

实施指南

开发者文档

  1. 准备最多 9 个图像参考(角色设计、环境情绪板、风格参考、产品镜头等),并将每个图像上传到可公开访问的 URL。创建这些图像 URL 的列表。 2. 准备最多 3 个音频文件(旁白、音乐音轨、背景环境音),并将每个文件上传到公开 URL。创建这些音频 URL 的列表。 3. 编写提示词,按照图像在列表中的顺序使用 @image1、@image2 等引用图像,并使用 @audio1、@audio2 等引用音频(例如“让 @image1 中的角色随着 @audio1 音乐跳舞,穿过有 @audio2 海浪环境音的 @image2 海滩场景进行转场”)。 4. 选择 aspect_ratio 和所需时长。 5. 提交——模型会协调所有引用的视觉和音频元素生成视频。

常见问题

常见问答

全能参考的费用是多少?

Seedance 2 全能参考在 muapi 上每次生成的费用为 $1.25。该单次费用涵盖将最多 9 个图像参考和 3 个音频参考处理为一段协调的视频。

如何在提示词中引用特定的图像和音频文件?

图像按照你在 images_list 中列出的顺序使用 @image1、@image2 等进行引用。音频文件按照其在 audio_files 中出现的顺序使用 @audio1、@audio2 等进行引用。提示词决定每个元素的使用方式,例如“@image1 展示主产品并转场到 @image2 的生活方式场景”,同时“@audio1”贯穿全程进行旁白。

支持哪些音频和图像格式?

音频应使用标准格式(MP3、WAV、AAC)。图像可以使用 JPEG、PNG 或 WebP。所有文件都必须能通过公开 URL 访问。规划视频构图时,应考虑音频时长和图像宽高比。