ByteDance 的 SD 2 文生视频(Pro)。根据文本提示词生成高质量电影感视频,支持原生音视频同步、最高 2K 分辨率和 4–15 秒时长。
关于此模型
SD 2 文生视频(Pro)可根据文本提示词生成高质量电影感视频。该模型由 ByteDance 最新 SD 2 模型驱动,支持原生音视频同步、最高 2K 分辨率,以及 4 到 15 秒的时长。Pro 模型优先追求质量而非速度。
成本分析
| 提供商 | 费用 | 备注 |
|---|---|---|
| muapiapp | $0.25 每秒 (e.g. $1.25 for 5 seconds) | 按生成视频的秒数计费。 |
| Fal.ai | $0.3024/秒 (高质量) / $0.2419/秒 (基础) | Fal.ai 的高质量费率为 $0.3024/秒,基础质量为 $0.2419/秒;muapiapp 的高质量费率($0.25/秒)便宜 17%,基础质量($0.12/秒)便宜 50%。 |
| Replicate | $0.3024/秒 (高质量) / $0.2419/秒 (基础) | Replicate 与 Fal.ai 收费相同:高质量为 $0.3024/秒,基础质量为 $0.2419/秒。muapiapp 根据质量档位可节省 17–50%。 |
按生成视频的秒数计费。
Fal.ai 的高质量费率为 $0.3024/秒,基础质量为 $0.2419/秒;muapiapp 的高质量费率($0.25/秒)便宜 17%,基础质量($0.12/秒)便宜 50%。
Replicate 与 Fal.ai 收费相同:高质量为 $0.3024/秒,基础质量为 $0.2419/秒。muapiapp 根据质量档位可节省 17–50%。
** 竞品价格根据相似模型架构和使用层级估算。
配置参数
| 参数 | 类型 | 描述 | 默认值 |
|---|---|---|---|
| 提示词 | string | 要生成的视频的文本描述。使用 @character:<id> 将视频锚定到 Seedance 2 角色,这会自动切换到图生视频模式。 | A cinematic shot of a futuristic city at night with neon lights reflecting on wet streets. |
| 画面比例 | 枚举(6 个选项) | 输出视频的画面比例。 | 16:9 |
| 时长(秒) | int | 视频时长(秒)。 | 5 |
要生成的视频的文本描述。使用 @character:<id> 将视频锚定到 Seedance 2 角色,这会自动切换到图生视频模式。
A cinematic shot of a futuristic city at night with neon lights reflecting on wet streets.输出视频的画面比例。
16:9视频时长(秒)。
5开发者文档
编写提示词:详细描述场景、运动、光照和情绪。提示词越具体,结果越好。
设置画面比例:从 21:9、16:9、4:3、1:1、3:4 或 9:16 中选择,以匹配目标平台。
设置时长:选择 4 到 15 秒。时长越长,费用越高。
提交并轮询:提交请求以获取 request_id,然后轮询 /predictions/{id}/result,直到状态为 completed。
常见问答
Pro 模型(`sd-2-text-to-video`)优先追求输出质量,并运行完整的 SD 2 模型。Fast 版本(`sd-2-text-to-video-fast`)采用更轻量的推理流程,以更低成本更快返回结果。
支持六种比例:21:9、16:9、4:3、1:1、3:4 和 9:16。默认值为 16:9。
可以生成 4 到 15 秒的视频。默认时长为 5 秒。