ByteDance 的 SD 2 全能参考 VIP(Pro)。通过优先路由,使用最多 9 张图像参考、3 个视频片段和 3 个音频参考生成视频。在プロンプト中使用 @image1…@image9、@video1…@video3 和 @audio1…@audio3 引用素材。还支持使用 @omni-character:<char_id> 引用训练角色。
このモデルについて
SD 2 全能参考 VIP(Pro)通过优先路由,使用最多 9 个图像参考和最多 3 个音频参考生成视频。在プロンプト中使用 @image1–@image9 和 @audio1–@audio3 语法引用已上传的素材。支持通过 @character:<id> 使用角色表,通过 @omni-character:<char_id> 使用训练角色,从而在多次生成中保持身份一致性。
コスト分析
| プロバイダー | 費用 | 備考 |
|---|---|---|
| muapiapp | $0.30/sec (pro) | VIP 优先路由并支持多参考内容——非常适合角色一致和音频同步生成。 |
| Fal.ai | 提供なし | SD 2 Omni Reference VIP not available. |
| Replicate | 提供なし | SD 2 Omni Reference VIP not available. |
VIP 优先路由并支持多参考内容——非常适合角色一致和音频同步生成。
SD 2 Omni Reference VIP not available.
SD 2 Omni Reference VIP not available.
** 競合サービスの料金は類似のモデル構成および利用ティアに基づいて算出された推定値です。
設定スキーマ
| パラメータ | 型 | 説明 | デフォルト |
|---|---|---|---|
| プロンプト | string | Video description. Use @image1…@image9 to reference images, @video1…@video3 for videos, and @audio1…@audio3 for audio. Use @character:<request_id> for a Seedance 2 character sheet or @omni-character:<char_id> for a trained Kinovi character. Multiple characters are supported. | @image1 is the main character. The person walks along a city street at sunset, cinematic lighting. |
| 画像 URL | array | 最多 9 个参考画像 URL(JPEG/PNG/WebP)。第 N 张画像对应プロンプト中的 @imageN。 | https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg |
| 参考動画 URL | array | 最多 3 个参考動画片段 URL(MP4,每个最长 15 秒)。第 N 个動画对应プロンプト中的 @videoN。 | undefined |
| 参考音声 URL | array | Up to 3 reference audio files (MP3/WAV, total max 15s). Each Nth audio corresponds to @audioN in the prompt. | undefined |
| アスペクト比 | Enum(6個の選択肢) | 出力動画的アスペクト比。 | 16:9 |
| 長さ(秒)(秒) | int | 動画生成時間(秒)。 | 5 |
| 高比特率 | boolean | 启用高比特率模式以获得更好的画面保真度,但会生成更大的文件。 | false |
Video description. Use @image1…@image9 to reference images, @video1…@video3 for videos, and @audio1…@audio3 for audio. Use @character:<request_id> for a Seedance 2 character sheet or @omni-character:<char_id> for a trained Kinovi character. Multiple characters are supported.
@image1 is the main character. The person walks along a city street at sunset, cinematic lighting.最多 9 个参考画像 URL(JPEG/PNG/WebP)。第 N 张画像对应プロンプト中的 @imageN。
https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg最多 3 个参考動画片段 URL(MP4,每个最长 15 秒)。第 N 个動画对应プロンプト中的 @videoN。
undefinedUp to 3 reference audio files (MP3/WAV, total max 15s). Each Nth audio corresponds to @audioN in the prompt.
undefined出力動画的アスペクト比。
16:9動画生成時間(秒)。
5启用高比特率模式以获得更好的画面保真度,但会生成更大的文件。
false開発者ドキュメント
上传参考素材:在 images_list 中添加最多 9 张图像,在 audio_files 中添加最多 3 个音频文件。文件按位置引用——第 1 张图像是 @image1,第 2 张是 @image2,以此类推。
编写プロンプト:明确引用素材:"@image1 是主角。这个人在日落时分沿着城市街道行走。"。加入 @audio1 可生成音频同步场景。
使用角色参考:添加 @character:<request_id>,以使用 SD 2 角色生成中的角色表。使用 @omni-character:<char_id> 可引用训练的全能角色(支持原生角色 ID)。
设置アスペクト比和时长:从标准アスペクト比中选择,并设置 4–15 秒的时长。
提交并获取结果:使用 request_id 进行轮询,或提供 webhook_url。
FAQ
使用 @image1、@image2 等,按 images_list 中的位置引用图像。使用 @audio1、@audio2 等引用 audio_files 中的音频。使用 @character:<request_id> 引用 SD 2 角色表,或使用 @omni-character:<char_id> 引用训练的全能角色。
将音频文件(MP3/WAV,总时长最长 15 秒)上传到 audio_files,并在プロンプト中使用 @audio1 引用。模型会生成与音频节奏和内容在视觉上同步的视频。
@character:<request_id> 使用已完成的 SD 2 角色生成中的角色表图像——该图像会注入 images_list,并在プロンプト中引用。@omni-character:<char_id> 直接使用训练的全能角色 ID,通过原生角色路径实现更深层的身份一致性。
最多 9 张图像(images_list)和最多 3 个音频文件(audio_files,总时长最长 15 秒)。如有需要,音频文件会自动裁剪。