Seedance 2 全能参考: Image-to-Video

ByteDance 的 SD 2 全能参考。使用最多 9 个图像参考和最多 3 个音频参考生成视频。在prompt中使用 @image1、@image2 等引用图像,使用 @audio1、@audio2 等引用音频。

📝

Overview

About this model

Updated 16 juil. 2026

Seedance 2 全能参考是一款全面的多模态视频生成工具,可在单次生成中组合最多 9 个图像参考和最多 3 个音频参考。图像参考在prompt中标记为 @image1、@image2 等,音频文件标记为 @audio1、@audio2 等,让你能够精确控制哪些元素作为视频的锚点。它非常适合叙事驱动的制作、音乐视频、品牌内容,以及需要多个视觉和声音元素和谐共存的复杂视觉叙事。

非常适合需要复杂多元素协调的电影制作人、音乐视频导演、商业制片人和创作者。muapi 的统一 API 每次生成收费 $1.25,无需传统多轨制作工作流的复杂性,即可使用这项高级能力。

1制作与多条音轨同步、包含多样视觉元素和场景的音乐视频
2结合产品镜头、生活方式图像和旁白音频,生成品牌视频叙事
3制作交织角色参考、环境图像和背景音乐的动画序列
4构建具有协调视觉主题、多个人物和分层音景的复杂故事项目
💰

Pricing & Value

Cost analysis

muapiapp$1.25 per generation

Single transparent price covers complex multi-element video coordination. No subscription needed—pay only per video, making sophisticated reference-driven production accessible without expensive production software.

** Competitor pricing is estimated based on similar model architectures and usage tiers.

⚙️

Technical Details

Configuration schema

Promptstring

Video description. Use @image1…@image9 to reference images and @audio1…@audio3 for audio. To use a character sheet, reference it with @character:<request_id> (from a completed Seedance 2 Character generation). To use a trained Omni Reference character, reference it with @omni-character:<character_id> where character_id is the value returned by Omni Reference Train Character (e.g. char_1775422630065_4vbana). Both methods can be combined in the same prompt. Multiple characters are supported. Example: '@omni-character:char_1775422630065_4vbana walking through a neon-lit city at night'.

Default Value@image1 is the main character. The person walks along a city street at sunset, cinematic lighting.
Image URLarray

最多 9 个参考image URL(JPEG/PNG/WebP)。第 N 张image对应prompt中的 @imageN。

Default Valuehttps://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg
参考Audio URLarray

Up to 3 reference audio files (MP3/WAV, total max 15s). Each Nth audio corresponds to @audioN in the prompt.

Default Valueundefined
Format d'imageEnum (4 options)

résultatvidéo的format d'image。

Default Value16:9
Durée (secondes)(秒)int

Video duration in seconds (4–15).

Default Value5
📖

Implementation Guide

Developer documentation

  1. 准备最多 9 个图像参考(角色设计、环境情绪板、风格参考、产品镜头等),并将每个图像上传到可公开访问的 URL。创建这些图像 URL 的列表。 2. 准备最多 3 个音频文件(旁白、音乐音轨、背景环境音),并将每个文件上传到公开 URL。创建这些音频 URL 的列表。 3. 编写prompt,按照图像在列表中的顺序使用 @image1、@image2 等引用图像,并使用 @audio1、@audio2 等引用音频(例如“让 @image1 中的角色随着 @audio1 音乐跳舞,穿过有 @audio2 海浪环境音的 @image2 海滩场景进行转场”)。 4. 选择 aspect_ratio 和所需时长。 5. 提交——模型会协调所有引用的视觉和音频元素生成视频。

Common Questions

Frequently asked

全能参考的费用是多少?

Seedance 2 全能参考在 muapi 上每次生成的费用为 $1.25。该单次费用涵盖将最多 9 个图像参考和 3 个音频参考处理为一段协调的视频。

如何在prompt中引用特定的图像和音频文件?

图像按照你在 images_list 中列出的顺序使用 @image1、@image2 等进行引用。音频文件按照其在 audio_files 中出现的顺序使用 @audio1、@audio2 等进行引用。prompt决定每个元素的使用方式,例如“@image1 展示主产品并转场到 @image2 的生活方式场景”,同时“@audio1”贯穿全程进行旁白。

支持哪些音频和图像格式?

音频应使用标准格式(MP3、WAV、AAC)。图像可以使用 JPEG、PNG 或 WebP。所有文件都必须能通过公开 URL 访问。规划视频构图时,应考虑音频时长和图像宽高比。