Integreer het gemini-audio-vision AI-model via krachtige API's met lage latentie en betalen naar verbruik.
About this model
Krijg programmatische toegang tot het gemini-audio-vision-model op MuAPI met directe schaalbaarheid en lage latentie.
Cost analysis
| Provider | Cost | Notes |
|---|---|---|
| muapiapp | $2.00/M 输入 Token, $5.00/M 输出 Token (higher per-run minimum for 音频) | Token-based billing with 无需订阅 — pay only for what you use, including the higher token cost of audio input. |
| Fal.ai | Niet beschikbaar | Fal.ai 的视觉端点仅支持图像;它们无法通过 Gemini 文件 API 原生理解音频。 |
| Replicate | Niet beschikbaar | Replicate 目前不提供托管的 Gemini 音频理解端点。 |
Token-based billing with 无需订阅 — pay only for what you use, including the higher token cost of audio input.
Fal.ai 的视觉端点仅支持图像;它们无法通过 Gemini 文件 API 原生理解音频。
Replicate 目前不提供托管的 Gemini 音频理解端点。
** Competitor pricing is estimated based on similar model architectures and usage tiers.
Configuration schema
| Parameter | Type | Description | Default |
|---|---|---|---|
| Prompt | string | 描述要分析的音频内容的问题或指令。 | Describe what is said and any background sounds in this audio, including speaker changes and tone. |
| Audio URL | string | 要分析的音频 URL。 | https://d3adwkbyhxyrtq.cloudfront.net/webassets/audiomodels/sample-audio.mp3 |
| 系统Prompt | string | 可选的 system-level instruction to guide the model's analysis style. | Respond with a structured JSON analysis, not prose. |
| 模型 | Enum (1 options) | 用于音频理解的 Gemini 模型。 | gemini-2.5-flash |
描述要分析的音频内容的问题或指令。
Describe what is said and any background sounds in this audio, including speaker changes and tone.要分析的音频 URL。
https://d3adwkbyhxyrtq.cloudfront.net/webassets/audiomodels/sample-audio.mp3可选的 system-level instruction to guide the model's analysis style.
Respond with a structured JSON analysis, not prose.用于音频理解的 Gemini 模型。
gemini-2.5-flashDeveloper documentation
Stuur een POST-verzoek naar het endpoint met uw gewenste parameters en MuAPI-sleutel.
Frequently asked