Veo 4 图生视频: 图像转视频

Veo 4 图生视频——使用 Veo 4 的运动合成引擎让任意静态图像动起来,在最高 1080p 下支持细致的镜头控制和逼真的物理效果。

📝

概览

关于此模型

Veo 4 图生视频使用 Google DeepMind 第四代运动合成引擎为静态图像添加动画。它根据单张输入图像生成物理准确的运动、逼真的光线变化和流畅的镜头控制,分辨率最高可达 1080p。

可选的文本提示词让你指定镜头运动、主体动作和氛围,精准控制场景呈现动态的方式。

1产品可视化:通过环绕镜头和动态光线让产品镜头动起来。
2照片级真实动画:在保留细节的同时,为高分辨率摄影作品添加运动。
3预可视化:将分镜画格制作成动画,预览镜头构图。
4数字艺术:通过电影感运动让插画和概念艺术焕发生命。
5营销:使用现有图像素材制作高影响力视频广告。
💰

价格与价值

成本分析

muapi$3.00 每次生成

Flat per-generation rate for 1080p output — no per-second 收费.

Fal.ai暂不可用

Fal.ai 目前不提供 Veo 4。

Replicate暂不可用

Replicate 目前不提供 Veo 4。

** 竞品价格根据相似模型架构和使用层级估算。

⚙️

技术详情

配置参数

图像array

上传或提供要制作动画的图像。

默认值https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg
提示词string

可选的 text description guiding the motion and camera movement.

默认值Camera slowly pans left, parallax depth, cinematic lighting.
画面比例枚举(3 个选项)

输出视频的画面比例。

默认值16:9
时长(秒)int

视频时长(秒)。

默认值8
📖

实施指南

开发者文档

如何使用 Veo 4 图生视频

  1. 提供图像 通过 images_list 上传或提供高分辨率图像的链接。输入质量越高,输出越好——建议源图像至少为 720p 分辨率。

  2. 添加运动提示词(可选) 描述镜头运动和主体动作。示例:'镜头围绕主体缓慢顺时针环绕,浅景深,电影感。' 没有提示词时,Veo 4 会从场景推断自然运动。

  3. 设置时长和画面比例 选择 5–30 秒和所需画面比例。若比例不同,图像会被智能裁剪或填充。

  4. 提交并轮询 POST 到 /api/v1/veo-4-image-to-video,并轮询直到 statuscompleted

  5. 提示

    • 使用明确的镜头名称('parallax'、'crane up'、'rack focus')以获得电影感效果。
    • 高对比度、光线充足且具有清晰深度线索的图像动画效果最佳。
    • 避免使用过度压缩或带水印的源图像。

常见问题

常见问答

图生视频必须提供文本提示词吗?

不需要。提示词是可选的。Veo 4 会从图像推断自然运动。添加提示词可引导镜头运动、主体动作或整体氛围。

最高输出分辨率是多少?

Veo 4 最高输出 1080p,具体分辨率取决于所选画面比例。

可以制作多张图像的动画吗?

图生视频模型使用单个起始帧。需要控制起始帧和结束帧时,未来计划推出 First & Last Frame 版本。

输出视频可以有多长?

Veo 4 图生视频支持 5 到 30 秒的时长。

Veo 4 什么时候可以使用?

Veo 4 目前正在开发中。请查看更新页面获取上线公告。Veo 3 图生视频现已可用。