ByteDance 的 SD 2 首尾帧(Pro)。生成在两张参考图像之间过渡的视频。提供 1 张图像可仅设置起始帧,或提供 2 张图像同时设置起始帧和结束帧。
关于此模型
SD 2 首尾帧(Pro)可生成在参考图像之间过渡的视频。提供 1 张图像作为开场帧,或提供 2 张图像来约束视频的起始帧和结束帧。该模型由 ByteDance 的 SD 2 模型驱动,支持最高 2K 分辨率和 4–15 秒时长。
成本分析
| 提供商 | 费用 | 备注 |
|---|---|---|
| muapiapp | $0.25 每秒 (e.g. $1.25 for 5 seconds) | 按生成视频的秒数计费。 |
| Fal.ai | $0.3024/秒 (高质量) / $0.2419/秒 (基础) | Fal.ai 收费 $0.3024/sec for high 质量 and $0.2419/sec for basic. muapiapp is 17% 更便宜 on high ($0.25/sec) and 50% 更便宜 on basic ($0.12/sec equivalent). |
| Replicate | $0.3024/秒 (高质量) / $0.2419/秒 (基础) | Replicate 与 Fal.ai 收费相同:高质量为 $0.3024/秒,基础质量为 $0.2419/秒。muapiapp 根据质量档位可节省 17–50%。 |
按生成视频的秒数计费。
Fal.ai 收费 $0.3024/sec for high 质量 and $0.2419/sec for basic. muapiapp is 17% 更便宜 on high ($0.25/sec) and 50% 更便宜 on basic ($0.12/sec equivalent).
Replicate 与 Fal.ai 收费相同:高质量为 $0.3024/秒,基础质量为 $0.2419/秒。muapiapp 根据质量档位可节省 17–50%。
** 竞品价格根据相似模型架构和使用层级估算。
配置参数
| 参数 | 类型 | 描述 | 默认值 |
|---|---|---|---|
| 提示词 | string | 指导帧间过渡的文本描述。 | Two people having a street interview, the interviewer holds a microphone. |
| 帧图像 | array | 1 张图像仅作为首帧;2 张图像作为首帧和末帧。使用 'adaptive' 画面比例以匹配参考图像几何结构。 | https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg |
| 画面比例 | 枚举(7 个选项) | 输出视频画面比例。'adaptive' 会匹配参考图像(推荐);具体比例可能会裁剪或补边。 | adaptive |
| 时长(秒) | int | 视频时长(秒)。 | 5 |
指导帧间过渡的文本描述。
Two people having a street interview, the interviewer holds a microphone.1 张图像仅作为首帧;2 张图像作为首帧和末帧。使用 'adaptive' 画面比例以匹配参考图像几何结构。
https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg输出视频画面比例。'adaptive' 会匹配参考图像(推荐);具体比例可能会裁剪或补边。
adaptive视频时长(秒)。
5开发者文档
上传 1 或 2 张图像:通过 images_list 提供图像。第一张图像是开场帧;第二张(可选)图像是结束帧。
编写提示词:描述两帧之间应发生的动作或转场。
设置时长:设置为 4 到 15 秒。
提交并轮询:使用返回的 request_id 轮询结果。画面比例由输入图像决定。
常见问答
不需要。提供 1 张图像时,它仅作为第一帧;提供 2 张图像时,系统会同时约束视频的起始帧和结束帧。
不可以——输出画面比例会根据参考图像的尺寸自动确定。
支持 JPEG、PNG、WebP 和 BMP。