gemini-audio-vision API — MuAPI: AI Large Language Models

gemini-audio-vision yapay zeka modelini yüksek performanslı API ve esnek fiyatlandırma ile entegre edin.

📝

Overview

About this model

MuAPI üzerinde gemini-audio-vision modeline düşük gecikme süresi ve anında ölçeklenebilirlik ile programatik erişim sağlayın.

1Multimedya içerik üretimi
2Yapay zeka ürün entegrasyonu
3Otomatik iş akışları
💰

Pricing & Value

Cost analysis

muapiapp$2.00/M input tokens, $5.00/M output tokens (higher per-run minimum for audio)

Token-based billing with no subscription — pay only for what you use, including the higher token cost of audio input.

Fal.aiMevcut değil

Fal.ai ; Gemini API 。

ReplicateMevcut değil

Replicate Gemini 。

** Competitor pricing is estimated based on similar model architectures and usage tiers.

⚙️

Technical Details

Configuration schema

Komut İstemi (Prompt)string

Default ValueDescribe what is said and any background sounds in this audio, including speaker changes and tone.
Ses URLstring

URL。

Default Valuehttps://d3adwkbyhxyrtq.cloudfront.net/webassets/audiomodels/sample-audio.mp3
Komut İstemi (Prompt)string

system-level instruction to guide the model's analysis style.

Default ValueRespond with a structured JSON analysis, not prose.
modelEnum (1 options)

Gemini 。

Default Valuegemini-2.5-flash
📖

Implementation Guide

Developer documentation

MuAPI anahtarınız ve istenen parametrelerle endpoint'e POST isteği gönderin.

Common Questions

Frequently asked