Veo 4 テキストから動画生成——Google DeepMind 第四代模型,可生成逼真的高保真 1080p 视频,具备出色的プロンプト遵循能力和シネマティック镜头控制。
このモデルについて
Veo 4 是 Google DeepMind 的第四代视频生成模型,以最高 1080p 提供业界领先的照片级真实感。它可根据自然语言描述生成电影级视频,并具备出色的プロンプト遵循能力、逼真的物理效果和精准的镜头运动控制。
Veo 4 基于空间理解和时间连贯性方面的进步,即使是包含多个主体的复杂场景,也能保持一致的光照和运动动力学,从而为テキストから動画生成质量树立新的标杆。
コスト分析
| プロバイダー | 費用 | 備考 |
|---|---|---|
| muapi | $3.00 per generation | Flat rate per generation — no per-second billing. Competitively priced for 1080p output quality. |
| Fal.ai | 提供なし | Fal.ai 目前不提供 Veo 4。 |
| Replicate | 提供なし | Replicate 目前不提供 Veo 4。 |
Flat rate per generation — no per-second billing. Competitively priced for 1080p output quality.
Fal.ai 目前不提供 Veo 4。
Replicate 目前不提供 Veo 4。
** 競合サービスの料金は類似のモデル構成および利用ティアに基づいて算出された推定値です。
設定スキーマ
| パラメータ | 型 | 説明 | デフォルト |
|---|---|---|---|
| プロンプト | string | 目标動画内容的文本描述。 | A cinematic aerial shot of a city at dusk, golden hour lighting, slow dolly forward. |
| アスペクト比 | Enum(3個の選択肢) | 出力動画的アスペクト比。 | 16:9 |
| 長さ(秒)(秒) | int | 動画生成時間(秒)。 | 8 |
目标動画内容的文本描述。
A cinematic aerial shot of a city at dusk, golden hour lighting, slow dolly forward.出力動画的アスペクト比。
16:9動画生成時間(秒)。
8開発者ドキュメント
编写详细プロンプト Veo 4 擅长遵循精确指令。包含主体、动作、环境、光线、镜头运动和氛围。示例:'无人机镜头在日出时升过雾气笼罩的山谷,展现下方的中世纪村庄,シネマティック调色,缓慢推进。'
设置时长 选择 5 到 30 秒。较长时长适合叙事序列;较短片段适合循环和转场。
选择アスペクト比
16:9 — 标准宽屏9:16 — 移动端竖屏1:1 — 方形格式提交并轮询
POST 到 /api/v1/veo-4-text-to-video,并轮询 GET /api/v1/predictions/{request_id}/result,直到 status 为 completed。
获得最佳结果的提示
FAQ
Veo 4 的出力分辨率更高(最高 1080p,而非 720p),プロンプト遵循能力更强、物理模拟更逼真,镜头控制也更精细。
Veo 4 支持每次生成 5 到 30 秒的时长。
音频生成支持将在上线时确认。请查看更新页面了解详情。
Veo 4 最高出力 1080p,具体取决于所选アスペクト比。
Veo 4 目前正在 muapi 开发中。请查看更新页面获取上线公告。如果你今天就需要视频生成功能,可以使用现已可用的 Veo 3。