ByteDance 的 SD 2 首尾帧(Pro)。生成在两张参考图像之间过渡的视频。提供 1 张图像可仅设置起始帧,或提供 2 张图像同时设置起始帧和结束帧。
About this model
SD 2 首尾帧(Pro)可生成在参考图像之间过渡的视频。提供 1 张图像作为开场帧,或提供 2 张图像来约束视频的起始帧和结束帧。该模型由 ByteDance 的 SD 2 模型驱动,支持最高 2K 分辨率和 4–15 秒时长。
Cost analysis
| Provider | Cost | Notes |
|---|---|---|
| muapiapp | $0.25 per second (e.g. $1.25 for 5 seconds) | Cobrança por segundos de vídeo gerados. |
| Fal.ai | $0.3024/sec (high) / $0.2419/sec (basic) | Fal.ai charges $0.3024/sec for high quality and $0.2419/sec for basic. muapiapp is 17% cheaper on high ($0.25/sec) and 50% cheaper on basic ($0.12/sec equivalent). |
| Replicate | $0.3024/sec (high) / $0.2419/sec (basic) | Replicate 与 Fal.ai 收费相同:高质量为 $0.3024/秒,基础质量为 $0.2419/秒。muapiapp 根据质量档位可节省 17–50%。 |
Cobrança por segundos de vídeo gerados.
Fal.ai charges $0.3024/sec for high quality and $0.2419/sec for basic. muapiapp is 17% cheaper on high ($0.25/sec) and 50% cheaper on basic ($0.12/sec equivalent).
Replicate 与 Fal.ai 收费相同:高质量为 $0.3024/秒,基础质量为 $0.2419/秒。muapiapp 根据质量档位可节省 17–50%。
** Competitor pricing is estimated based on similar model architectures and usage tiers.
Configuration schema
| Parameter | Type | Description | Default |
|---|---|---|---|
| Prompt | string | 指导帧间过渡的文本描述。 | Two people having a street interview, the interviewer holds a microphone. |
| 帧Imagem | array | 1 张Imagem仅作为首帧;2 张Imagem作为首帧和末帧。使用 'adaptive' Proporção以匹配参考Imagem几何结构。 | https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg |
| Proporção | Enum (7 options) | SaídaVídeoProporção。'adaptive' 会匹配参考Imagem(推荐);具体比例可能会裁剪或补边。 | adaptive |
| Duração (segundos)(秒) | int | VídeoDuração(秒)。 | 5 |
指导帧间过渡的文本描述。
Two people having a street interview, the interviewer holds a microphone.1 张Imagem仅作为首帧;2 张Imagem作为首帧和末帧。使用 'adaptive' Proporção以匹配参考Imagem几何结构。
https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpgSaídaVídeoProporção。'adaptive' 会匹配参考Imagem(推荐);具体比例可能会裁剪或补边。
adaptiveVídeoDuração(秒)。
5Developer documentation
上传 1 或 2 张图像:通过 images_list 提供图像。第一张图像是开场帧;第二张(可选)图像是结束帧。
编写Prompt:描述两帧之间应发生的动作或转场。
设置时长:设置为 4 到 15 秒。
提交并轮询:使用返回的 request_id 轮询结果。Proporção由Entrada图像决定。
Frequently asked
不需要。提供 1 张图像时,它仅作为第一帧;提供 2 张图像时,系统会同时约束视频的起始帧和结束帧。
不可以——SaídaProporção会根据参考图像的尺寸自动确定。
支持 JPEG、PNG、WebP 和 BMP。