关于此模型
Veo 4 是 Google DeepMind 的第四代视频生成模型,以最高 1080p 提供业界领先的照片级真实感。它可根据自然语言描述生成电影级视频,并具备出色的提示词遵循能力、逼真的物理效果和精准的镜头运动控制。
Veo 4 基于空间理解和时间连贯性方面的进步,即使是包含多个主体的复杂场景,也能保持一致的光照和运动动力学,从而为文生视频质量树立新的标杆。
成本分析
| 提供商 | 费用 | 备注 |
|---|---|---|
| muapi | $3.00 每次生成 | Flat rate 每次生成 — no per-second billing. Competitively priced for 1080p output 质量. |
| Fal.ai | 暂不可用 | Fal.ai 目前不提供 Veo 4。 |
| Replicate | 暂不可用 | Replicate 目前不提供 Veo 4。 |
Flat rate 每次生成 — no per-second billing. Competitively priced for 1080p output 质量.
Fal.ai 目前不提供 Veo 4。
Replicate 目前不提供 Veo 4。
** 竞品价格根据相似模型架构和使用层级估算。
配置参数
| 参数 | 类型 | 描述 | 默认值 |
|---|---|---|---|
| 提示词 | string | 目标视频内容的文本描述。 | A cinematic aerial shot of a city at dusk, golden hour lighting, slow dolly forward. |
| 画面比例 | 枚举(3 个选项) | 输出视频的画面比例。 | 16:9 |
| 时长(秒) | int | 视频时长(秒)。 | 8 |
目标视频内容的文本描述。
A cinematic aerial shot of a city at dusk, golden hour lighting, slow dolly forward.输出视频的画面比例。
16:9视频时长(秒)。
8开发者文档
编写详细提示词 Veo 4 擅长遵循精确指令。包含主体、动作、环境、光线、镜头运动和氛围。示例:'无人机镜头在日出时升过雾气笼罩的山谷,展现下方的中世纪村庄,电影感调色,缓慢推进。'
设置时长 选择 5 到 30 秒。较长时长适合叙事序列;较短片段适合循环和转场。
选择画面比例
16:9 — 标准宽屏9:16 — 移动端竖屏1:1 — 方形格式提交并轮询
POST 到 /api/v1/veo-4-text-to-video,并轮询 GET /api/v1/predictions/{request_id}/result,直到 status 为 completed。
获得最佳结果的提示
常见问答
Veo 4 的输出分辨率更高(最高 1080p,而非 720p),提示词遵循能力更强、物理模拟更逼真,镜头控制也更精细。
Veo 4 支持每次生成 5 到 30 秒的时长。
音频生成支持将在上线时确认。请查看更新页面了解详情。
Veo 4 最高输出 1080p,具体取决于所选画面比例。
Veo 4 目前正在 muapi 开发中。请查看更新页面获取上线公告。如果你今天就需要视频生成功能,可以使用现已可用的 Veo 3。