Veo 4 テキストから動画生成: AI動画生成

Veo 4 テキストから動画生成——Google DeepMind 第四代模型,可生成逼真的高保真 1080p 视频,具备出色的プロンプト遵循能力和シネマティック镜头控制。

📝

概要

このモデルについて

Veo 4 是 Google DeepMind 的第四代视频生成模型,以最高 1080p 提供业界领先的照片级真实感。它可根据自然语言描述生成电影级视频,并具备出色的プロンプト遵循能力、逼真的物理效果和精准的镜头运动控制。

Veo 4 基于空间理解和时间连贯性方面的进步,即使是包含多个主体的复杂场景,也能保持一致的光照和运动动力学,从而为テキストから動画生成质量树立新的标杆。

1影视与广告:根据脚本和分镜生成可用于播出的高质量视频内容。
2シネマティック原型:在实拍或 VFX 制作前预可视化场景。
3创意营销活动:为提案和演示制作高保真的概念视频。
4训练数据:规模化生成多样、照片级真实的视频数据集。
5教育:为复杂概念和主题制作说明性视频内容。
💰

料金と価値

コスト分析

muapi$3.00 per generation

Flat rate per generation — no per-second billing. Competitively priced for 1080p output quality.

Fal.ai提供なし

Fal.ai 目前不提供 Veo 4。

Replicate提供なし

Replicate 目前不提供 Veo 4。

** 競合サービスの料金は類似のモデル構成および利用ティアに基づいて算出された推定値です。

⚙️

技術詳細

設定スキーマ

プロンプトstring

目标動画内容的文本描述。

デフォルト値A cinematic aerial shot of a city at dusk, golden hour lighting, slow dolly forward.
アスペクト比Enum(3個の選択肢)

出力動画的アスペクト比。

デフォルト値16:9
長さ(秒)(秒)int

動画生成時間(秒)。

デフォルト値8
📖

実装ガイド

開発者ドキュメント

使用方法 Veo 4 テキストから動画生成

  1. 编写详细プロンプト Veo 4 擅长遵循精确指令。包含主体、动作、环境、光线、镜头运动和氛围。示例:'无人机镜头在日出时升过雾气笼罩的山谷,展现下方的中世纪村庄,シネマティック调色,缓慢推进。'

  2. 设置时长 选择 5 到 30 秒。较长时长适合叙事序列;较短片段适合循环和转场。

  3. 选择アスペクト比

    • 16:9 — 标准宽屏
    • 9:16 — 移动端竖屏
    • 1:1 — 方形格式
  4. 提交并轮询 POST 到 /api/v1/veo-4-text-to-video,并轮询 GET /api/v1/predictions/{request_id}/result,直到 statuscompleted

  5. 获得最佳结果的提示

    • 明确写出镜头运动:'tracking shot'、'handheld'、'crane up'、'dolly zoom'
    • 指定光线:'golden hour'、'overcast diffused light'、'neon-lit night scene'
    • 对于多主体场景,清楚描述每个主体的位置和动作。

よくある質問

FAQ

Veo 4 与 Veo 3 相比如何?

Veo 4 的出力分辨率更高(最高 1080p,而非 720p),プロンプト遵循能力更强、物理模拟更逼真,镜头控制也更精细。

最大视频时长是多少?

Veo 4 支持每次生成 5 到 30 秒的时长。

Veo 4 支持音频生成吗?

音频生成支持将在上线时确认。请查看更新页面了解详情。

Veo 4 出力什么分辨率?

Veo 4 最高出力 1080p,具体取决于所选アスペクト比。

Veo 4 什么时候可以使用?

Veo 4 目前正在 muapi 开发中。请查看更新页面获取上线公告。如果你今天就需要视频生成功能,可以使用现已可用的 Veo 3。