ByteDance 的 SD 2 全能参考 VIP 1080p。通过优先路由,使用最多 9 个图像参考、最多 3 个视频片段和最多 3 个音频参考生成全高清视频。在提示词中使用 @image1…@image9、@video1…@video3 和 @audio1…@audio3 引用参考素材。
关于此模型
Seedance 2 全能参考 VIP 1080p 是一款多模态视频生成模型,允许你在单次生成中组合最多 9 张图像、3 个视频片段和 3 个音频文件作为参考。你不必只为一张图像制作动画,而是可以编写丰富的提示词,使用 @image1 到 @image9、@video1 到 @video3 以及 @audio1 到 @audio3 的标记来引用这些素材。模型会综合所有输入,生成一段连贯的 1080p 视频,并遵循你提供的视觉和音频特征,在 4 到 15 秒内实现原生视听同步。
这是复杂创意项目的首选:编辑现有素材并加入视觉参考、叠加多条音轨,或融合来自多个来源的风格参考。通过 muapi 统一 API 使用,无需订阅,只在生成时付费。
成本分析
| 提供商 | 费用 | 备注 |
|---|---|---|
| muapiapp | $3.38 每次生成 | Muapi 收费 a flat per-generation rate regardless of how many reference materials you include, making multi-modal video creation affordable and predictable. |
Muapi 收费 a flat per-generation rate regardless of how many reference materials you include, making multi-modal video creation affordable and predictable.
** 竞品价格根据相似模型架构和使用层级估算。
配置参数
| 参数 | 类型 | 描述 | 默认值 |
|---|---|---|---|
| 提示词 | string | Video description. Use @image1…@image9 to 参考图像, @video1…@video3 for videos, and @audio1…@audio3 for audio. Use @character:<request_id> for a Seedance 2 character sheet or @omni-character:<char_id> for a trained Kinovi character. Multiple characters are supported. | @image1 is the main character. The person walks along a city street at sunset, cinematic lighting. |
| 图像 URL | array | 最多 9 个参考图像 URL(JPEG/PNG/WebP)。第 N 张图像对应提示词中的 @imageN。 | https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg |
| 参考视频 URL | array | 最多 3 个参考视频片段 URL(MP4,每个最长 15 秒)。第 N 个视频对应提示词中的 @videoN。 | undefined |
| 参考音频 URL | array | 最多 3 参考音频 files (MP3/WAV, total max 15s). Each Nth audio corresponds to @audioN in the prompt. | undefined |
| 画面比例 | 枚举(6 个选项) | 输出视频的画面比例。 | 16:9 |
| 时长(秒) | int | 视频时长(秒)。 | 5 |
| 高比特率 | boolean | 启用高比特率模式以获得更好的画面保真度,但会生成更大的文件。 | false |
Video description. Use @image1…@image9 to 参考图像, @video1…@video3 for videos, and @audio1…@audio3 for audio. Use @character:<request_id> for a Seedance 2 character sheet or @omni-character:<char_id> for a trained Kinovi character. Multiple characters are supported.
@image1 is the main character. The person walks along a city street at sunset, cinematic lighting.最多 9 个参考图像 URL(JPEG/PNG/WebP)。第 N 张图像对应提示词中的 @imageN。
https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg最多 3 个参考视频片段 URL(MP4,每个最长 15 秒)。第 N 个视频对应提示词中的 @videoN。
undefined最多 3 参考音频 files (MP3/WAV, total max 15s). Each Nth audio corresponds to @audioN in the prompt.
undefined输出视频的画面比例。
16:9视频时长(秒)。
5启用高比特率模式以获得更好的画面保真度,但会生成更大的文件。
false开发者文档
常见问答
可以同时提供所有素材,模型会根据提示词指令使用它们。不过,提示词的清晰度很重要——明确指出哪个参考应占主导地位或各个参考应如何互动,比没有清晰指导地提供参考素材能产生更好的结果。
图像使用 @image1 到 @image9 引用,视频使用 @video1 到 @video3 引用,音频片段使用 @audio1 到 @audio3 引用。例如:“@image1 是主图,@video1 提供背景运动,@audio1 是旁白。”只能引用实际上传的文件。
该模型每次生成收费 $3.38。尽管需要处理多种参考类型,价格仍然简单透明——无需订阅,也不会按参考素材数量额外收费,只需支付单次生成费用。