Sora 2 的 I2V 可通过自然运动、音频和视觉效果,将静态图像动画化为短视频片段。虽然发布初期不支持真实人物肖像,但你可以使用物体、风景、风格化角色或场景。通过详细提示词描述镜头运动、氛围和节奏,即可获得最佳效果。
关于此模型
Sora 2 的 I2V 是先进的图生视频模型,可将静态图像转换为动态且富有吸引力的视频片段。借助先进的神经网络架构和精密的运动合成技术,Sora 2 能够生成自然的镜头运动、氛围效果和同步音频,让每个场景栩栩如生。该模型经过优化,可处理多种视觉内容,包括风景、风格化角色和动画对象。
Sora 2 的 I2V 兼具精准性与创造力,其突出之处在于用户可以通过详细提示词控制镜头角度、节奏和氛围。虽然发布初期不支持真实人物肖像,但该模型擅长根据精心构图的图像生成生动、电影感十足的序列。它将技术实力与创作灵活性融为一体,非常适合数字叙事、广告和艺术项目。
成本分析
| 提供商 | 费用 | 备注 |
|---|---|---|
| muapiapp | $1.5 每次生成 | muapiapp offers this service at $1.5 每次生成, making it 20-50% 更实惠 than competing providers while delivering comparable or superior 质量. |
| Fal.ai | $2.0 每次生成 | Fal.ai 收费 $2.0 每次生成. muapiapp is 20-50% 更便宜, providing a cost-effective solution without compromising 性能. |
| Replicate | $2.0 每次生成 | Replicate also offers similar 定价 at $2.0 每次生成. Choosing muapiapp means you benefit from a 20-50% cost advantage while receiving high-质量 output. |
muapiapp offers this service at $1.5 每次生成, making it 20-50% 更实惠 than competing providers while delivering comparable or superior 质量.
Fal.ai 收费 $2.0 每次生成. muapiapp is 20-50% 更便宜, providing a cost-effective solution without compromising 性能.
Replicate also offers similar 定价 at $2.0 每次生成. Choosing muapiapp means you benefit from a 20-50% cost advantage while receiving high-质量 output.
** 竞品价格根据相似模型架构和使用层级估算。
配置参数
| 参数 | 类型 | 描述 | 默认值 |
|---|---|---|---|
| 提示词 | string | 用于生成视频的提示词 | Camera pans along the platform as the bullet train doors open, passengers step forward with rolling suitcases. Footsteps and soft chatter fill the air. A female announcer says: ‘Train number 2245 to Tokyo is now departing from platform 3.’ Wheels screech lightly as the train starts moving. |
| 图像 URL | array | 上传或提供图像 URL,用于图像转视频生成。 | https://d3adwkbyhxyrtq.cloudfront.net/webassets/videomodels/openai-sora-2-i2v.jpg |
| 画面比例 | 枚举(2 个选项) | 输出视频的画面比例。 | 16:9 |
| 时长 | 枚举(5 个选项) | 生成视频的时长(秒)。 | 8 |
用于生成视频的提示词
Camera pans along the platform as the bullet train doors open, passengers step forward with rolling suitcases. Footsteps and soft chatter fill the air. A female announcer says: ‘Train number 2245 to Tokyo is now departing from platform 3.’ Wheels screech lightly as the train starts moving.上传或提供图像 URL,用于图像转视频生成。
https://d3adwkbyhxyrtq.cloudfront.net/webassets/videomodels/openai-sora-2-i2v.jpg输出视频的画面比例。
16:9生成视频的时长(秒)。
8开发者文档
准备输入
提交请求
16:9 或 9:16)、时长(10 或 15 秒)以及水印设置。查看输出
按需优化
常见问答
你可以使用物体、风景、风格化角色或场景的图像。请注意,发布初期不支持真实人物肖像。
在提示词中加入详细说明。描述所需的镜头角度、运动(例如平移或缩放)、节奏,以及光照或音频提示等氛围元素。
可以,在 input schema 中启用 "Remove Watermark" 选项即可从最终视频输出中移除水印。
模型支持两种画面比例:16:9 和 9:16;你可以选择 10 秒或 15 秒的视频时长。