Seedance 2 全能参考 VIP: 画像から動画生成

ByteDance 的 SD 2 全能参考 VIP(Pro)。通过优先路由,使用最多 9 张图像参考、3 个视频片段和 3 个音频参考生成视频。在プロンプト中使用 @image1…@image9、@video1…@video3 和 @audio1…@audio3 引用素材。还支持使用 @omni-character:<char_id> 引用训练角色。

📝

概要

このモデルについて

SD 2 全能参考 VIP(Pro)通过优先路由,使用最多 9 个图像参考和最多 3 个音频参考生成视频。在プロンプト中使用 @image1–@image9 和 @audio1–@audio3 语法引用已上传的素材。支持通过 @character:<id> 使用角色表,通过 @omni-character:<char_id> 使用训练角色,从而在多次生成中保持身份一致性。

1角色一致性:使用参考图像和 @omni-character 训练 ID,在多个视频场景中保持角色外观一致。
2音频同步视频:生成与参考音频片段同步的视频,适用于音乐视频、旁白内容或节奏化运动。
3多模态参考:在单次请求中组合图像和音频参考,生成受丰富条件引导的视频。
4风格迁移:将参考图像作为视觉风格指南,以特定艺术风格生成新的视频场景。
💰

料金と価値

コスト分析

muapiapp$0.30/sec (pro)

VIP 优先路由并支持多参考内容——非常适合角色一致和音频同步生成。

Fal.ai提供なし

SD 2 Omni Reference VIP not available.

Replicate提供なし

SD 2 Omni Reference VIP not available.

** 競合サービスの料金は類似のモデル構成および利用ティアに基づいて算出された推定値です。

⚙️

技術詳細

設定スキーマ

プロンプトstring

Video description. Use @image1…@image9 to reference images, @video1…@video3 for videos, and @audio1…@audio3 for audio. Use @character:<request_id> for a Seedance 2 character sheet or @omni-character:<char_id> for a trained Kinovi character. Multiple characters are supported.

デフォルト値@image1 is the main character. The person walks along a city street at sunset, cinematic lighting.
画像 URLarray

最多 9 个参考画像 URL(JPEG/PNG/WebP)。第 N 张画像对应プロンプト中的 @imageN。

デフォルト値https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg
参考動画 URLarray

最多 3 个参考動画片段 URL(MP4,每个最长 15 秒)。第 N 个動画对应プロンプト中的 @videoN。

デフォルト値undefined
参考音声 URLarray

Up to 3 reference audio files (MP3/WAV, total max 15s). Each Nth audio corresponds to @audioN in the prompt.

デフォルト値undefined
アスペクト比Enum(6個の選択肢)

出力動画的アスペクト比。

デフォルト値16:9
長さ(秒)(秒)int

動画生成時間(秒)。

デフォルト値5
高比特率boolean

启用高比特率模式以获得更好的画面保真度,但会生成更大的文件。

デフォルト値false
📖

実装ガイド

開発者ドキュメント

使用方法 SD 2 VIP 全能参考

  1. 上传参考素材:在 images_list 中添加最多 9 张图像,在 audio_files 中添加最多 3 个音频文件。文件按位置引用——第 1 张图像是 @image1,第 2 张是 @image2,以此类推。

  2. 编写プロンプト:明确引用素材:"@image1 是主角。这个人在日落时分沿着城市街道行走。"。加入 @audio1 可生成音频同步场景。

  3. 使用角色参考:添加 @character:<request_id>,以使用 SD 2 角色生成中的角色表。使用 @omni-character:<char_id> 可引用训练的全能角色(支持原生角色 ID)。

  4. 设置アスペクト比和时长:从标准アスペクト比中选择,并设置 4–15 秒的时长。

  5. 提交并获取结果:使用 request_id 进行轮询,或提供 webhook_url

よくある質問

FAQ

什么是 @ 引用语法?

使用 @image1、@image2 等,按 images_list 中的位置引用图像。使用 @audio1、@audio2 等引用 audio_files 中的音频。使用 @character:<request_id> 引用 SD 2 角色表,或使用 @omni-character:<char_id> 引用训练的全能角色。

音频参考如何工作?

将音频文件(MP3/WAV,总时长最长 15 秒)上传到 audio_files,并在プロンプト中使用 @audio1 引用。模型会生成与音频节奏和内容在视觉上同步的视频。

@character 与 @omni-character 有什么区别?

@character:<request_id> 使用已完成的 SD 2 角色生成中的角色表图像——该图像会注入 images_list,并在プロンプト中引用。@omni-character:<char_id> 直接使用训练的全能角色 ID,通过原生角色路径实现更深层的身份一致性。

可以使用多少个参考素材?

最多 9 张图像(images_list)和最多 3 个音频文件(audio_files,总时长最长 15 秒)。如有需要,音频文件会自动裁剪。