ByteDance 的 SD 2 全能参考 VIP(Pro)。通过优先路由,使用最多 9 张图像参考、3 个视频片段和 3 个音频参考生成视频。在提示词中使用 @image1…@image9、@video1…@video3 和 @audio1…@audio3 引用素材。还支持使用 @omni-character:<char_id> 引用训练角色。
关于此模型
SD 2 全能参考 VIP(Pro)通过优先路由,使用最多 9 个图像参考和最多 3 个音频参考生成视频。在提示词中使用 @image1–@image9 和 @audio1–@audio3 语法引用已上传的素材。支持通过 @character:<id> 使用角色表,通过 @omni-character:<char_id> 使用训练角色,从而在多次生成中保持身份一致性。
成本分析
| 提供商 | 费用 | 备注 |
|---|---|---|
| muapiapp | $0.30/秒 (pro) | VIP 优先路由并支持多参考内容——非常适合角色一致和音频同步生成。 |
| Fal.ai | 暂不可用 | SD 2 Omni Reference VIP 不可用. |
| Replicate | 暂不可用 | SD 2 Omni Reference VIP 不可用. |
VIP 优先路由并支持多参考内容——非常适合角色一致和音频同步生成。
SD 2 Omni Reference VIP 不可用.
SD 2 Omni Reference VIP 不可用.
** 竞品价格根据相似模型架构和使用层级估算。
配置参数
| 参数 | 类型 | 描述 | 默认值 |
|---|---|---|---|
| 提示词 | string | Video description. Use @image1…@image9 to 参考图像, @video1…@video3 for videos, and @audio1…@audio3 for audio. Use @character:<request_id> for a Seedance 2 character sheet or @omni-character:<char_id> for a trained Kinovi character. Multiple characters are supported. | @image1 is the main character. The person walks along a city street at sunset, cinematic lighting. |
| 图像 URL | array | 最多 9 个参考图像 URL(JPEG/PNG/WebP)。第 N 张图像对应提示词中的 @imageN。 | https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg |
| 参考视频 URL | array | 最多 3 个参考视频片段 URL(MP4,每个最长 15 秒)。第 N 个视频对应提示词中的 @videoN。 | undefined |
| 参考音频 URL | array | 最多 3 参考音频 files (MP3/WAV, total max 15s). Each Nth audio corresponds to @audioN in the prompt. | undefined |
| 画面比例 | 枚举(6 个选项) | 输出视频的画面比例。 | 16:9 |
| 时长(秒) | int | 视频时长(秒)。 | 5 |
| 高比特率 | boolean | 启用高比特率模式以获得更好的画面保真度,但会生成更大的文件。 | false |
Video description. Use @image1…@image9 to 参考图像, @video1…@video3 for videos, and @audio1…@audio3 for audio. Use @character:<request_id> for a Seedance 2 character sheet or @omni-character:<char_id> for a trained Kinovi character. Multiple characters are supported.
@image1 is the main character. The person walks along a city street at sunset, cinematic lighting.最多 9 个参考图像 URL(JPEG/PNG/WebP)。第 N 张图像对应提示词中的 @imageN。
https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg最多 3 个参考视频片段 URL(MP4,每个最长 15 秒)。第 N 个视频对应提示词中的 @videoN。
undefined最多 3 参考音频 files (MP3/WAV, total max 15s). Each Nth audio corresponds to @audioN in the prompt.
undefined输出视频的画面比例。
16:9视频时长(秒)。
5启用高比特率模式以获得更好的画面保真度,但会生成更大的文件。
false开发者文档
上传参考素材:在 images_list 中添加最多 9 张图像,在 audio_files 中添加最多 3 个音频文件。文件按位置引用——第 1 张图像是 @image1,第 2 张是 @image2,以此类推。
编写提示词:明确引用素材:"@image1 是主角。这个人在日落时分沿着城市街道行走。"。加入 @audio1 可生成音频同步场景。
使用角色参考:添加 @character:<request_id>,以使用 SD 2 角色生成中的角色表。使用 @omni-character:<char_id> 可引用训练的全能角色(支持原生角色 ID)。
设置画面比例和时长:从标准画面比例中选择,并设置 4–15 秒的时长。
提交并获取结果:使用 request_id 进行轮询,或提供 webhook_url。
常见问答
使用 @image1、@image2 等,按 images_list 中的位置引用图像。使用 @audio1、@audio2 等引用 audio_files 中的音频。使用 @character:<request_id> 引用 SD 2 角色表,或使用 @omni-character:<char_id> 引用训练的全能角色。
将音频文件(MP3/WAV,总时长最长 15 秒)上传到 audio_files,并在提示词中使用 @audio1 引用。模型会生成与音频节奏和内容在视觉上同步的视频。
@character:<request_id> 使用已完成的 SD 2 角色生成中的角色表图像——该图像会注入 images_list,并在提示词中引用。@omni-character:<char_id> 直接使用训练的全能角色 ID,通过原生角色路径实现更深层的身份一致性。
最多 9 张图像(images_list)和最多 3 个音频文件(audio_files,总时长最长 15 秒)。如有需要,音频文件会自动裁剪。