Seedance 2 全能参考 VIP: Image-to-Video

ByteDance 的 SD 2 全能参考 VIP(Pro)。通过优先路由,使用最多 9 张图像参考、3 个视频片段和 3 个音频参考生成视频。在Prompt中使用 @image1…@image9、@video1…@video3 和 @audio1…@audio3 引用素材。还支持使用 @omni-character:<char_id> 引用训练角色。

📝

Overview

About this model

SD 2 全能参考 VIP(Pro)通过优先路由,使用最多 9 个图像参考和最多 3 个音频参考生成视频。在Prompt中使用 @image1–@image9 和 @audio1–@audio3 语法引用已上传的素材。支持通过 @character:<id> 使用角色表,通过 @omni-character:<char_id> 使用训练角色,从而在多次生成中保持身份一致性。

1角色一致性:使用参考图像和 @omni-character 训练 ID,在多个视频场景中保持角色外观一致。
2音频同步视频:生成与参考音频片段同步的视频,适用于音乐视频、旁白内容或节奏化运动。
3多模态参考:在单次请求中组合图像和音频参考,生成受丰富条件引导的视频。
4风格迁移:将参考图像作为视觉风格指南,以特定艺术风格生成新的视频场景。
💰

Pricing & Value

Cost analysis

muapiapp$0.30/sec (pro)

VIP 优先路由并支持多参考内容——非常适合角色一致和音频同步生成。

Fal.aiNão disponível

SD 2 Omni Reference VIP not available.

ReplicateNão disponível

SD 2 Omni Reference VIP not available.

** Competitor pricing is estimated based on similar model architectures and usage tiers.

⚙️

Technical Details

Configuration schema

Promptstring

Video description. Use @image1…@image9 to reference images, @video1…@video3 for videos, and @audio1…@audio3 for audio. Use @character:<request_id> for a Seedance 2 character sheet or @omni-character:<char_id> for a trained Kinovi character. Multiple characters are supported.

Default Value@image1 is the main character. The person walks along a city street at sunset, cinematic lighting.
Imagem URLarray

最多 9 个参考Imagem URL(JPEG/PNG/WebP)。第 N 张Imagem对应Prompt中的 @imageN。

Default Valuehttps://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg
参考Vídeo URLarray

最多 3 个参考Vídeo片段 URL(MP4,每个最长 15 秒)。第 N 个Vídeo对应Prompt中的 @videoN。

Default Valueundefined
参考Áudio URLarray

Up to 3 reference audio files (MP3/WAV, total max 15s). Each Nth audio corresponds to @audioN in the prompt.

Default Valueundefined
ProporçãoEnum (6 options)

SaídaVídeo的Proporção。

Default Value16:9
Duração (segundos)(秒)int

VídeoDuração(秒)。

Default Value5
高比特率boolean

启用高比特率模式以获得更好的画面保真度,但会生成更大的文件。

Default Valuefalse
📖

Implementation Guide

Developer documentation

Como Usar SD 2 VIP 全能参考

  1. 上传参考素材:在 images_list 中添加最多 9 张图像,在 audio_files 中添加最多 3 个音频文件。文件按位置引用——第 1 张图像是 @image1,第 2 张是 @image2,以此类推。

  2. 编写Prompt:明确引用素材:"@image1 是主角。这个人在日落时分沿着城市街道行走。"。加入 @audio1 可生成音频同步场景。

  3. 使用角色参考:添加 @character:<request_id>,以使用 SD 2 角色生成中的角色表。使用 @omni-character:<char_id> 可引用训练的全能角色(支持原生角色 ID)。

  4. 设置Proporção和时长:从标准Proporção中选择,并设置 4–15 秒的时长。

  5. 提交并获取结果:使用 request_id 进行轮询,或提供 webhook_url

Common Questions

Frequently asked

什么是 @ 引用语法?

使用 @image1、@image2 等,按 images_list 中的位置引用图像。使用 @audio1、@audio2 等引用 audio_files 中的音频。使用 @character:<request_id> 引用 SD 2 角色表,或使用 @omni-character:<char_id> 引用训练的全能角色。

音频参考如何工作?

将音频文件(MP3/WAV,总时长最长 15 秒)上传到 audio_files,并在Prompt中使用 @audio1 引用。模型会生成与音频节奏和内容在视觉上同步的视频。

@character 与 @omni-character 有什么区别?

@character:<request_id> 使用已完成的 SD 2 角色生成中的角色表图像——该图像会注入 images_list,并在Prompt中引用。@omni-character:<char_id> 直接使用训练的全能角色 ID,通过原生角色路径实现更深层的身份一致性。

可以使用多少个参考素材?

最多 9 张图像(images_list)和最多 3 个音频文件(audio_files,总时长最长 15 秒)。如有需要,音频文件会自动裁剪。