Veo 4 is Google DeepMind's latest video model — generate up to 30 seconds of photorealistic 1080p video with simultaneous multi-angle camera rendering, zero-shot personalized avatar creation, and native audio sync. Veo 4 API access is coming soon.
API 尚未开放
Veo 4 endpoints are in development. Watch the explore page for the launch announcement. Veo 3 is available now.
Veo 4 is Google DeepMind's most advanced video generation model, purpose-built for professional-grade AI video at scale. It generates up to 30 continuous seconds of photorealistic native 1080p video from a text prompt or input image — with zero upscaling artifacts. Unlike earlier models, Veo 4 renders simultaneous multi-angle camera perspectives in a single pass, unlocking cinematic production workflows that previously required multiple generations and manual compositing.
Developers and studios choose Veo 4 for its zero-shot personalized avatar creation — a single reference photo is all it takes to generate a photorealistic digital presenter — and for its phoneme-accurate native audio synchronization, which embeds synchronized speech, sound effects, and ambient audio directly into the video output without post-processing. Access Veo 4 via the Muapi REST API using the same submit-and-poll pattern as Veo 3, with no infrastructure to manage.
Further reading: Google Veo 3.1 on Muapi and the best AI video models of 2026.
30 秒片段
每次请求最多生成连续 30 秒视频,适合广告、预告片和社交内容。
原生 1080p 分辨率
无需放大即可输出全高清画面,保留每一帧的细节。
多角度摄像机渲染
在一次生成中模拟同时存在的多个摄像机角度。
零样本头像创建
仅凭一张参考照片即可创建写实的个性化头像,无需微调。
音素级精准音频同步
在音素级别同步原生语音和声音生成。
テキストから動画生成与画像から動画生成
根据文本提示词生成视频,或将任意输入图像制作成视频。
电影级广告
制作最长 30 秒、具有专业运动和音频的品牌视频与产品演示。
个性化头像视频
仅凭一张照片创建用于入门培训、在线学习或社交媒体的自定义头像主持人。
社交媒体内容
生成适合 TikTok、Reels 和 YouTube Shorts 的竖屏与横屏片段。
游戏与 VFX 原型
快速制作电影感过场动画和视觉特效序列原型。
广播与流媒体
为流媒体平台和数字媒体制作 1080p、适合广播的内容。
| 功能 | Veo 4 | Veo 3 |
|---|---|---|
| 最长时长 | 最长 30 秒 | 最长 8 秒 |
| 分辨率 | 原生 1080p | 720p–1080p |
| 音频 | 原生音素级精准音频同步 | 原生音频生成 |
| 头像创建 | 单张照片零样本创建 | 不支持 |
| 摄像机控制 | 同时多角度渲染 | 单一摄像机路径 |
| 状态 | 即将在 Muapi 上线 | 已在 Muapi 上线 |
什么是 Veo 4 API?
Veo 4 API 是 Google DeepMind 的下一代视频生成模型。它可以根据文本提示词或输入图像生成最长 30 秒的写实 1080p 视频,并支持多角度摄像机渲染、零样本个性化头像创建和音素级精准原生音频同步。
Veo 4 与 Veo 3 有什么区别?
Veo 4 在 Veo 3 的基础上提供更长片段(最长 30 秒,而不是 8 秒)、原生 1080p、同时多角度摄像机渲染,以及根据单张参考照片零样本创建头像。Veo 3 目前已在 Muapi 提供テキストから動画生成和画像から動画生成。
Veo 4 API 什么时候可用?
Veo 4 API 目前正在 Muapi 开发中,请关注探索页面的发布公告。在此期间,Veo 3 已可通过 API 用于高质量 AI 视频生成。
Veo 4 支持原生音频生成吗?
支持。Veo 4 内置音素级精准音频同步,可以在视频输出中生成同步语音、音效和环境声,无需单独后期处理。
Veo 4 支持哪些画幅和分辨率?
Veo 4 原生支持竖屏和横屏 1080p 输出,每次生成最长 30 秒。具体画幅选项将在发布时确认。
正在寻找 Veo 3?
Veo 3 现提供中,テキストから動画生成和画像から動画生成均可通过 API 使用。