关于此模型
Veo 4 图生视频使用 Google DeepMind 第四代运动合成引擎为静态图像添加动画。它根据单张输入图像生成物理准确的运动、逼真的光线变化和流畅的镜头控制,分辨率最高可达 1080p。
可选的文本提示词让你指定镜头运动、主体动作和氛围,精准控制场景呈现动态的方式。
成本分析
| 提供商 | 费用 | 备注 |
|---|---|---|
| muapi | $3.00 每次生成 | Flat per-generation rate for 1080p output — no per-second 收费. |
| Fal.ai | 暂不可用 | Fal.ai 目前不提供 Veo 4。 |
| Replicate | 暂不可用 | Replicate 目前不提供 Veo 4。 |
Flat per-generation rate for 1080p output — no per-second 收费.
Fal.ai 目前不提供 Veo 4。
Replicate 目前不提供 Veo 4。
** 竞品价格根据相似模型架构和使用层级估算。
配置参数
| 参数 | 类型 | 描述 | 默认值 |
|---|---|---|---|
| 图像 | array | 上传或提供要制作动画的图像。 | https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg |
| 提示词 | string | 可选的 text description guiding the motion and camera movement. | Camera slowly pans left, parallax depth, cinematic lighting. |
| 画面比例 | 枚举(3 个选项) | 输出视频的画面比例。 | 16:9 |
| 时长(秒) | int | 视频时长(秒)。 | 8 |
上传或提供要制作动画的图像。
https://d3adwkbyhxyrtq.cloudfront.net/ai-images/186/712345784292/4a8c5c70-abcc-4920-873e-b0e219986453.jpg可选的 text description guiding the motion and camera movement.
Camera slowly pans left, parallax depth, cinematic lighting.输出视频的画面比例。
16:9视频时长(秒)。
8开发者文档
提供图像
通过 images_list 上传或提供高分辨率图像的链接。输入质量越高,输出越好——建议源图像至少为 720p 分辨率。
添加运动提示词(可选) 描述镜头运动和主体动作。示例:'镜头围绕主体缓慢顺时针环绕,浅景深,电影感。' 没有提示词时,Veo 4 会从场景推断自然运动。
设置时长和画面比例 选择 5–30 秒和所需画面比例。若比例不同,图像会被智能裁剪或填充。
提交并轮询
POST 到 /api/v1/veo-4-image-to-video,并轮询直到 status 为 completed。
提示
常见问答
不需要。提示词是可选的。Veo 4 会从图像推断自然运动。添加提示词可引导镜头运动、主体动作或整体氛围。
Veo 4 最高输出 1080p,具体分辨率取决于所选画面比例。
图生视频模型使用单个起始帧。需要控制起始帧和结束帧时,未来计划推出 First & Last Frame 版本。
Veo 4 图生视频支持 5 到 30 秒的时长。
Veo 4 目前正在开发中。请查看更新页面获取上线公告。Veo 3 图生视频现已可用。