Veo 4 文生视频: AI 视频生成器

Veo 4 文生视频——Google DeepMind 第四代模型,可生成逼真的高保真 1080p 视频,具备出色的提示词遵循能力和电影感镜头控制。

📝

概览

关于此模型

Veo 4 是 Google DeepMind 的第四代视频生成模型,以最高 1080p 提供业界领先的照片级真实感。它可根据自然语言描述生成电影级视频,并具备出色的提示词遵循能力、逼真的物理效果和精准的镜头运动控制。

Veo 4 基于空间理解和时间连贯性方面的进步,即使是包含多个主体的复杂场景,也能保持一致的光照和运动动力学,从而为文生视频质量树立新的标杆。

1影视与广告:根据脚本和分镜生成可用于播出的高质量视频内容。
2电影感原型:在实拍或 VFX 制作前预可视化场景。
3创意营销活动:为提案和演示制作高保真的概念视频。
4训练数据:规模化生成多样、照片级真实的视频数据集。
5教育:为复杂概念和主题制作说明性视频内容。
💰

价格与价值

成本分析

muapi$3.00 每次生成

Flat rate 每次生成 — no per-second billing. Competitively priced for 1080p output 质量.

Fal.ai暂不可用

Fal.ai 目前不提供 Veo 4。

Replicate暂不可用

Replicate 目前不提供 Veo 4。

** 竞品价格根据相似模型架构和使用层级估算。

⚙️

技术详情

配置参数

提示词string

目标视频内容的文本描述。

默认值A cinematic aerial shot of a city at dusk, golden hour lighting, slow dolly forward.
画面比例枚举(3 个选项)

输出视频的画面比例。

默认值16:9
时长(秒)int

视频时长(秒)。

默认值8
📖

实施指南

开发者文档

如何使用 Veo 4 文生视频

  1. 编写详细提示词 Veo 4 擅长遵循精确指令。包含主体、动作、环境、光线、镜头运动和氛围。示例:'无人机镜头在日出时升过雾气笼罩的山谷,展现下方的中世纪村庄,电影感调色,缓慢推进。'

  2. 设置时长 选择 5 到 30 秒。较长时长适合叙事序列;较短片段适合循环和转场。

  3. 选择画面比例

    • 16:9 — 标准宽屏
    • 9:16 — 移动端竖屏
    • 1:1 — 方形格式
  4. 提交并轮询 POST 到 /api/v1/veo-4-text-to-video,并轮询 GET /api/v1/predictions/{request_id}/result,直到 statuscompleted

  5. 获得最佳结果的提示

    • 明确写出镜头运动:'tracking shot'、'handheld'、'crane up'、'dolly zoom'
    • 指定光线:'golden hour'、'overcast diffused light'、'neon-lit night scene'
    • 对于多主体场景,清楚描述每个主体的位置和动作。

常见问题

常见问答

Veo 4 与 Veo 3 相比如何?

Veo 4 的输出分辨率更高(最高 1080p,而非 720p),提示词遵循能力更强、物理模拟更逼真,镜头控制也更精细。

最大视频时长是多少?

Veo 4 支持每次生成 5 到 30 秒的时长。

Veo 4 支持音频生成吗?

音频生成支持将在上线时确认。请查看更新页面了解详情。

Veo 4 输出什么分辨率?

Veo 4 最高输出 1080p,具体取决于所选画面比例。

Veo 4 什么时候可以使用?

Veo 4 目前正在 muapi 开发中。请查看更新页面获取上线公告。如果你今天就需要视频生成功能,可以使用现已可用的 Veo 3。