gemini-video-vision API | MuAPI: AI Large Language Models

Jelajahi dan integrasikan model AI gemini-video-vision melalui MuAPI. Dapatkan inferensi berkecepatan tinggi dan harga kompetitif.

📝

Overview

About this model

Model gemini-video-vision menyediakan kemampuan generasi AI mutakhir di platform MuAPI.

1Aplikasi produksi dengan gemini-video-vision
2Aplikasi produksi dengan gemini-video-vision
3Aplikasi produksi dengan gemini-video-vision
4Aplikasi produksi dengan gemini-video-vision
5Aplikasi produksi dengan gemini-video-vision
💰

Pricing & Value

Cost analysis

muapiapp$0.60/M input tokens, $5.00/M output tokens (higher per-run minimum for video)

Token-based billing with no subscription — pay only for what you use, including the higher token cost of video input.

Fal.aiTidak tersedia

Fal.ai 的视觉端点仅支持图像;它们无法通过 Gemini 文件 API 原生理解视频。

ReplicateTidak tersedia

Replicate 目前不提供托管的 Gemini 视频理解端点。

** Competitor pricing is estimated based on similar model architectures and usage tiers.

⚙️

Technical Details

Configuration schema

Prompt Teksstring

描述要分析的Video内容的问题或指令。

Default ValueDescribe what happens in this video in detail, including camera movement, subjects, and any on-screen text.
Video URLstring

要分析的Video URL。

Default Valuehttps://d3adwkbyhxyrtq.cloudfront.net/webassets/videomodels/sample-video.mp4
系统Prompt Teksstring

Optional system-level instruction to guide the model's analysis style.

Default ValueRespond with a structured JSON analysis, not prose.
模型Enum (1 options)

用于Video理解的 Gemini 模型。由于 Google 已停止向新用户提供 gemini-2.5-pro,该选项已从此枚举中移除(会返回 404 NOT_FOUND);gemini-2.5-flash 是当前唯一Mendukung的选项。

Default Valuegemini-2.5-flash
📖

Implementation Guide

Developer documentation

Panduan integrasi cepat untuk gemini-video-vision. Hubungkan dengan kunci API MuAPI Anda dan mulai lakukan panggilan inferensi.

Common Questions

Frequently asked

Gemini Video Vision 可以做什么?

它利用 Google Gemini 的原生视频理解能力分析完整视频,而不只是采样帧,并返回涵盖运动、构图、主体、光照以及屏幕文字或对话上下文的详细文本描述。

支持哪些视频格式和时长?

支持 MP4、MOV 和 WebM 等标准视频格式。视频越长,处理时间和成本通常越高,因为 Gemini 的 token 用量会随视频时长增长。

如何计算价格?

价格按 token 计费。视频输入消耗的 token 明显多于文本或单张图像,因此每次运行的最低收费高于 Muapi 的纯文本 Gemini 端点。实际成本根据 API 响应计算,并在每次调用后从你的钱包中扣除。

`gemini-2.5-flash` 和 `gemini-2.5-pro` 有什么区别?

`gemini-2.5-flash` 速度更快、成本更低,适合大多数描述和质量检查任务。`gemini-2.5-pro` 提供更深入的推理,更适合详细的逐镜头拆解等复杂分析。

可以控制输出格式吗?

可以。使用 system_prompt 字段 instruct 模型以特定格式响应,例如结构化 JSON、项目符号列表或单句摘要。

请求需要多长时间?

处理时间取决于视频长度和复杂度。短片段通常在几秒内完成;较长视频可能需要几分钟,因为分析开始前必须上传并摄取完整视频。