Seedance 2 全能参考 VIP: 图像转视频

ByteDance 的 SD 2 全能参考 VIP(Pro)。通过优先路由,使用最多 9 张图像参考、3 个视频片段和 3 个音频参考生成视频。在提示词中使用 @image1…@image9、@video1…@video3 和 @audio1…@audio3 引用素材。还支持使用 @omni-character:<char_id> 引用训练角色。

📝

概览

关于此模型

SD 2 全能参考 VIP(Pro)通过优先路由,使用最多 9 个图像参考和最多 3 个音频参考生成视频。在提示词中使用 @image1–@image9 和 @audio1–@audio3 语法引用已上传的素材。支持通过 @character:<id> 使用角色表,通过 @omni-character:<char_id> 使用训练角色,从而在多次生成中保持身份一致性。

1角色一致性:使用参考图像和 @omni-character 训练 ID,在多个视频场景中保持角色外观一致。
2音频同步视频:生成与参考音频片段同步的视频,适用于音乐视频、旁白内容或节奏化运动。
3多模态参考:在单次请求中组合图像和音频参考,生成受丰富条件引导的视频。
4风格迁移:将参考图像作为视觉风格指南,以特定艺术风格生成新的视频场景。
💰

价格与价值

成本分析

muapiapp$0.30/秒 (pro)

VIP 优先路由并支持多参考内容——非常适合角色一致和音频同步生成。

Fal.ai暂不可用

SD 2 Omni Reference VIP 不可用.

Replicate暂不可用

SD 2 Omni Reference VIP 不可用.

** 竞品价格根据相似模型架构和使用层级估算。

⚙️

技术详情

配置参数

提示词string

Video description. Use @image1…@image9 to 参考图像, @video1…@video3 for videos, and @audio1…@audio3 for audio. Use @character:<request_id> for a Seedance 2 character sheet or @omni-character:<char_id> for a trained Kinovi character. Multiple characters are supported.

默认值@image1 is the main character. The person walks along a city street at sunset, cinematic lighting.
图像 URLarray

最多 9 个参考图像 URL(JPEG/PNG/WebP)。第 N 张图像对应提示词中的 @imageN。

默认值https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg
参考视频 URLarray

最多 3 个参考视频片段 URL(MP4,每个最长 15 秒)。第 N 个视频对应提示词中的 @videoN。

默认值undefined
参考音频 URLarray

最多 3 参考音频 files (MP3/WAV, total max 15s). Each Nth audio corresponds to @audioN in the prompt.

默认值undefined
画面比例枚举(6 个选项)

输出视频的画面比例。

默认值16:9
时长(秒)int

视频时长(秒)。

默认值5
高比特率boolean

启用高比特率模式以获得更好的画面保真度,但会生成更大的文件。

默认值false
📖

实施指南

开发者文档

如何使用 SD 2 VIP 全能参考

  1. 上传参考素材:在 images_list 中添加最多 9 张图像,在 audio_files 中添加最多 3 个音频文件。文件按位置引用——第 1 张图像是 @image1,第 2 张是 @image2,以此类推。

  2. 编写提示词:明确引用素材:"@image1 是主角。这个人在日落时分沿着城市街道行走。"。加入 @audio1 可生成音频同步场景。

  3. 使用角色参考:添加 @character:<request_id>,以使用 SD 2 角色生成中的角色表。使用 @omni-character:<char_id> 可引用训练的全能角色(支持原生角色 ID)。

  4. 设置画面比例和时长:从标准画面比例中选择,并设置 4–15 秒的时长。

  5. 提交并获取结果:使用 request_id 进行轮询,或提供 webhook_url

常见问题

常见问答

什么是 @ 引用语法?

使用 @image1、@image2 等,按 images_list 中的位置引用图像。使用 @audio1、@audio2 等引用 audio_files 中的音频。使用 @character:<request_id> 引用 SD 2 角色表,或使用 @omni-character:<char_id> 引用训练的全能角色。

音频参考如何工作?

将音频文件(MP3/WAV,总时长最长 15 秒)上传到 audio_files,并在提示词中使用 @audio1 引用。模型会生成与音频节奏和内容在视觉上同步的视频。

@character 与 @omni-character 有什么区别?

@character:<request_id> 使用已完成的 SD 2 角色生成中的角色表图像——该图像会注入 images_list,并在提示词中引用。@omni-character:<char_id> 直接使用训练的全能角色 ID,通过原生角色路径实现更深层的身份一致性。

可以使用多少个参考素材?

最多 9 张图像(images_list)和最多 3 个音频文件(audio_files,总时长最长 15 秒)。如有需要,音频文件会自动裁剪。