Jelajahi dan integrasikan model AI gemini-video-vision melalui MuAPI. Dapatkan inferensi berkecepatan tinggi dan harga kompetitif.
About this model
Model gemini-video-vision menyediakan kemampuan generasi AI mutakhir di platform MuAPI.
Cost analysis
| Provider | Cost | Notes |
|---|---|---|
| muapiapp | $0.60/M input tokens, $5.00/M output tokens (higher per-run minimum for video) | Token-based billing with no subscription — pay only for what you use, including the higher token cost of video input. |
| Fal.ai | Tidak tersedia | Fal.ai 的视觉端点仅支持图像;它们无法通过 Gemini 文件 API 原生理解视频。 |
| Replicate | Tidak tersedia | Replicate 目前不提供托管的 Gemini 视频理解端点。 |
Token-based billing with no subscription — pay only for what you use, including the higher token cost of video input.
Fal.ai 的视觉端点仅支持图像;它们无法通过 Gemini 文件 API 原生理解视频。
Replicate 目前不提供托管的 Gemini 视频理解端点。
** Competitor pricing is estimated based on similar model architectures and usage tiers.
Configuration schema
| Parameter | Type | Description | Default |
|---|---|---|---|
| Prompt Teks | string | 描述要分析的Video内容的问题或指令。 | Describe what happens in this video in detail, including camera movement, subjects, and any on-screen text. |
| Video URL | string | 要分析的Video URL。 | https://d3adwkbyhxyrtq.cloudfront.net/webassets/videomodels/sample-video.mp4 |
| 系统Prompt Teks | string | Optional system-level instruction to guide the model's analysis style. | Respond with a structured JSON analysis, not prose. |
| 模型 | Enum (1 options) | 用于Video理解的 Gemini 模型。由于 Google 已停止向新用户提供 gemini-2.5-pro,该选项已从此枚举中移除(会返回 404 NOT_FOUND);gemini-2.5-flash 是当前唯一Mendukung的选项。 | gemini-2.5-flash |
描述要分析的Video内容的问题或指令。
Describe what happens in this video in detail, including camera movement, subjects, and any on-screen text.要分析的Video URL。
https://d3adwkbyhxyrtq.cloudfront.net/webassets/videomodels/sample-video.mp4Optional system-level instruction to guide the model's analysis style.
Respond with a structured JSON analysis, not prose.用于Video理解的 Gemini 模型。由于 Google 已停止向新用户提供 gemini-2.5-pro,该选项已从此枚举中移除(会返回 404 NOT_FOUND);gemini-2.5-flash 是当前唯一Mendukung的选项。
gemini-2.5-flashDeveloper documentation
Panduan integrasi cepat untuk gemini-video-vision. Hubungkan dengan kunci API MuAPI Anda dan mulai lakukan panggilan inferensi.
Frequently asked
它利用 Google Gemini 的原生视频理解能力分析完整视频,而不只是采样帧,并返回涵盖运动、构图、主体、光照以及屏幕文字或对话上下文的详细文本描述。
支持 MP4、MOV 和 WebM 等标准视频格式。视频越长,处理时间和成本通常越高,因为 Gemini 的 token 用量会随视频时长增长。
价格按 token 计费。视频输入消耗的 token 明显多于文本或单张图像,因此每次运行的最低收费高于 Muapi 的纯文本 Gemini 端点。实际成本根据 API 响应计算,并在每次调用后从你的钱包中扣除。
`gemini-2.5-flash` 速度更快、成本更低,适合大多数描述和质量检查任务。`gemini-2.5-pro` 提供更深入的推理,更适合详细的逐镜头拆解等复杂分析。
可以。使用 system_prompt 字段 instruct 模型以特定格式响应,例如结构化 JSON、项目符号列表或单句摘要。
处理时间取决于视频长度和复杂度。短片段通常在几秒内完成;较长视频可能需要几分钟,因为分析开始前必须上传并摄取完整视频。