Ovi Texto para Vídeo: AI Video Generator

Ovi 是统一模型,可从文本Entrada生成同步的视频与音频。你可以编写包含对白和环境声音的场景描述,Ovi 会生成一段短视频(通常约 5 秒),让画面与声音自然对齐。视频以 540p 分辨率生成。

📝

Overview

About this model

Ovi 是一款前沿的统一模型,能够根据文本Entrada无缝生成同步的视频和音频。用户只需一个Prompt,就能创建短小且引人入胜的视频片段,自然融合画面与声音,非常适合数字叙事、广告和快速多媒体原型制作。Ovi 基于复杂的生成算法,确保每段视频不仅视觉吸引人,声音也能保持同步,在清晰的 540p 分辨率下呈现近似传统拍摄的体验。

该模型利用先进的机器学习技术理解详细的场景描述、对白和环境声音,并将它们映射为连贯的视频Saída。这让创作者可以轻松将想象转化为有形媒体,弥合文本概念与动态视听内容之间的差距。其简洁的界面和高效处理能力使其成为极具竞争力且经济高效的解决方案,让用户只需极少Entrada和较短周转时间即可获得高质量结果。

1制作沉浸式短视频广告
2为电影制作人快速生成场景预览
3制作分镜并展示创意概念
4设计互动式社交媒体内容
5为多媒体项目快速构建原型
6为短篇叙事开发虚拟场景表演
7在教育和培训材料中进行视觉叙事
💰

Pricing & Value

Cost analysis

muapiapp$0.20 per generation

muapiapp is 20-50% more affordable compared to competitors while delivering comparable or superior quality.

Fal.ai$0.25 per generation

muapiapp offers a 20% discount over Fal.ai, providing excellent cost efficiency with high-quality video and audio outputs.

Replicate$0.25 per generation

muapiapp is priced at 20% less than Replicate, ensuring a more cost-effective solution without compromising on performance.

** Competitor pricing is estimated based on similar model architectures and usage tiers.

⚙️

Technical Details

Configuration schema

Promptstring

描述Vídeo内容的文本Prompt。

Default ValueA busy railway station intersection at day time. A loudspeaker voice announces: <S>Attention: Train 12785 to Mumbai is now boarding at Platform 3.<E>. Ambient: <AUDCAP>Car horns, crowd murmur, distant train whistle<ENDAUDCAP>.
ProporçãoEnum (2 options)

SaídaVídeo的Proporção。

Default Value16:9
📖

Implementation Guide

Developer documentation

Como Usar Ovi-text-to-video

  1. 准备Entrada:

    • 用纯文本编写详细的场景描述。加入对白,并使用相应标签指定环境声音(例如,<S> 表示对白,<AUDCAP> 表示环境音频)。
    • 示例:A busy railway station intersection at day time. A loudspeaker voice announces: <S>Attention: Train 12785 to Mumbai is now boarding at Platform 3.<E>. Ambient: <AUDCAP>Car horns, crowd murmur, distant train whistle<ENDAUDCAP>.
  2. 选择Proporção:

    • 根据目标Saída媒介选择合适的Proporção(16:99:16)。默认为 16:9
  3. 生成视频:

    • 提交Prompt和所选Proporção。Ovi 会处理请求并生成一段音频完美同步的约 5 秒视频片段。
  4. 查看并迭代:

    • 视频生成后,评估同步效果和整体质量。如有需要,调整EntradaPrompt并重新提交,以达到预期结果。

Common Questions

Frequently asked

Ovi 生成的视频是什么分辨率?

Ovi 以 540p 分辨率生成视频,在画面质量与生成速度之间取得平衡。

每段生成的视频片段有多长?

Ovi 生成的每段视频片段时长约为 5 秒。

Prompt中应包含哪些文本细节?

为了获得最佳结果,请加入详细的场景描述,使用 `<S>` 标签指定对白,并使用 `<AUDCAP>` 标签描述环境声音。清晰且有描述性的Prompt有助于模型理解你的创意构想。

支持不同的Proporção吗?

支持,你可以根据项目需求在 '16:9' 和 '9:16' Proporção之间进行选择。

与其他服务相比,Ovi 的性价比如何?

Ovi 的定价具有竞争力,每次生成 $0.20;与同类模型相比,它能在不牺牲质量的情况下提供显著的成本优势。