मॉडल/Google AI/Google Gemini API
लाइव एपीआई6 मॉडल

Google Gemini API — AI वीडियो, इमेज और टेक्स्ट-टू-स्पीच

MuAPI पर Google Gemini API Google के जनरेटिव मीडिया और लैंग्वेज मॉडल को एकीकृत करता है: Veo 3 और 3.1 वीडियो जनरेशन, Imagen 3 इमेज जनरेशन, Gemini TTS ऑडियो और Gemini 2.0 फ्लैश और प्रो मॉडल।Google Cloud कंसोल या जटिल IAM सेटअप के बिना एक ही डेवलपर एपीआई कुंजी के साथ Google के प्रमुख मीडिया और रीजनिंग मॉडल तक पहुँचें।

Nano Banana

Google इमेज जनरेशन और संपादन परिवार।1 मॉडल
टेक्स्ट टू इमेजNewFeatured
Nano Banana

Nano Banana 2

Nano Banana 2 — Google Gemini मल्टीमॉडल रीजनिंग और टेक्स्ट जनरेशन।

Image generation
$0.06/request
मॉडल आज़माएं

Imagen 4

Google टेक्स्ट-टू-इमेज मॉडल (मानक, तेज़ और अल्ट्रा स्तर)।1 मॉडल
टेक्स्ट टू इमेजLive
Imagen 4

Imagen 4 Fast

Imagen 4 Fast — Google Imagen यथार्थवादी टेक्स्ट-टू-इमेज मॉडल।

Image generationFast
$0.02/generation
मॉडल आज़माएं

Veo 3.1

Google Veo वीडियो जनरेशन, इमेज-टू-वीडियो और 4K संस्करण।2 मॉडल
टेक्स्ट टू वीडियोLive
Veo 3.1

Veo 3.1 Text to Video

Veo 3.1 Text to Video — Google Veo उच्च-गुणवत्ता सिनेमैटिक वीडियो जनरेशन।

Video generation
$2.50/request
मॉडल आज़माएं
टेक्स्ट टू वीडियोLive
Veo 3.1

Veo 3.1 Fast Text to Video

Veo 3.1 Fast Text to Video — Google Veo उच्च-गुणवत्ता सिनेमैटिक वीडियो जनरेशन।

Video generationFast
$0.60/request
मॉडल आज़माएं

Gemini Omni

सिंक्रनाइज़्ड ऑडियो के साथ वीडियो जनरेशन और संपादन वर्कफ़्लो।1 मॉडल
टेक्स्ट टू वीडियोLive
Gemini Omni

Gemini Omni Text to Video

Gemini Omni Text to Video — Google Gemini मल्टीमॉडल रीजनिंग और टेक्स्ट जनरेशन।

Video + synchronized audio
From $0.16
मॉडल आज़माएं

Gemini TTS

टेक्स्ट से प्राकृतिक और अभिव्यंजक बहु-स्पीकर संवाद ऑडियो जनरेट करें।1 मॉडल
टेक्स्ट टू स्पीचNew
Gemini TTS

Gemini 3.8 Flash TTS

Gemini 3.8 Flash TTS — प्राकृतिक आवाज़ संश्लेषण और बहु-भाषी ऑडियो जनरेशन।

Dialogue to audioFast
$0.015/1,000 chars
मॉडल आज़माएं

MuAPI पर Google Gemini मॉडल

MuAPI पर Google Gemini API Google के जनरेटिव मीडिया और लैंग्वेज मॉडल को एकीकृत करता है: Veo 3 और 3.1 वीडियो, Imagen 3 और 4 इमेज, Gemini TTS ऑडियो, और Gemini 2.0 फ्लैश और प्रो लैंग्वेज मॉडल।

Google Cloud कंसोल या जटिल IAM कुंजियों को सेट अप किए बिना एक ही MuAPI डेवलपर कुंजी के साथ Google के प्रमुख मीडिया और रीजनिंग मॉडल एक्सेस करें।

Google AI क्षमताएं

Veo 3.1 वीडियो

नेटिव सिंक्रनाइज़्ड ऑडियो के साथ 4K तक वीडियो जनरेशन।

Imagen 4 इमेज

असाधारण फोटोरियलिज्म और सटीक टाइपोग्राफी के साथ टेक्स्ट-टू-इमेज।

Gemini TTS

अभिव्यंजक, प्राकृतिक और बहु-भाषी टेक्स्ट-टू-स्पीच ऑडियो।

Gemini Omni

ऑडियो और वीडियो का एक साथ मल्टीमॉडल संश्लेषण।

Google AI API endpoints

FamilyInputOutputStarting priceFull lineup
Nano BananaPrompt and optional referencesImageFrom $0.03/request/nano-banana-api
Imagen 4PromptImageFrom $0.02/generation/imagen-4
Veo 3.1Prompt, image, or video referencesVideoFrom $0.30/request/veo-3.1
Gemini OmniPrompt, image, or video depending on endpointVideo, edits, or audioFrom $0.048/sec on selected endpoints/gemini-omni
Gemini TTSSpeaker and dialogue turnsAudioFrom $0.01/1,000 characters/gemini-tts

Pricing varies by model, duration, resolution, and endpoint. Confirm exact costs on each family page before submitting.

How to call the Google Gemini API

Submit a model-specific JSON request using your Muapi API key, save the request ID, and poll the shared result endpoint. Image, video, and speech endpoints use different request fields.

1. Generate an image with Nano Banana

curl -X POST https://api.muapi.ai/api/v1/nano-banana \
  -H "x-api-key: YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"prompt":"A small glass greenhouse on a mossy hillside at sunrise","aspect_ratio":"1:1"}'

# Response: {"request_id":"REQUEST_ID"}

Send a prompt to a Nano Banana image endpoint.

2. Generate an image with Imagen 4

curl -X POST https://api.muapi.ai/api/v1/google-imagen4 \
  -H "x-api-key: YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"prompt":"A richly detailed glasshouse at sunrise, dew on tropical leaves","aspect_ratio":"16:9","num_images":1}'

# Response: {"request_id":"REQUEST_ID"}

Submit a prompt and aspect ratio to Imagen 4.

3. Generate video with Veo 3.1

curl -X POST https://api.muapi.ai/api/v1/veo3.1-text-to-video \
  -H "x-api-key: YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"prompt":"A cinematic sunrise over a misty mountain valley","duration":8}'

# Response: {"request_id":"REQUEST_ID"}

Call Veo with a prompt and duration.

4. Generate video with Gemini Omni

curl -X POST https://api.muapi.ai/api/v1/gemini-omni-text-to-video \
  -H "x-api-key: YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"prompt":"A chef explains a recipe in a warm studio kitchen","resolution":"1080p","duration":8,"aspect_ratio":"16:9"}'

# Response: {"request_id":"REQUEST_ID"}

Create video with synchronized audio.

5. Generate speech with Gemini TTS

curl -X POST https://api.muapi.ai/api/v1/gemini-3-8-flash-tts \
  -H "x-api-key: YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"speakers":[{"speaker_id":"Speaker 1","voice_name":"Kore","accent":"Neutral","style":"Empathetic","pace":"Natural"}],"dialogue_turns":[{"speaker_id":"Speaker 1","text":"Welcome to the show."}]}'

# Response: {"request_id":"REQUEST_ID"}

Provide structured speaker and dialogue turns.

6. Poll for the completed output

curl https://api.muapi.ai/api/v1/predictions/REQUEST_ID/result \
  -H "x-api-key: YOUR_API_KEY"

# Poll until status is completed, then read the generated asset URL from outputs.

Use the returned request ID with the shared result endpoint.

Google Gemini API अक्सर पूछे जाने वाले प्रश्न

कौन से Google मॉडल उपलब्ध हैं?

Veo 3.1, Imagen 4, Nano Banana, Gemini TTS, और Gemini 2.0।

क्या Veo 3.1 में ऑडियो शामिल है?

हाँ, Veo 3.1 दृश्य के साथ नेटिव सिंक्रनाइज़्ड साउंड इफेक्ट्स जनरेट करता है।

क्या मुझे Google Cloud खाते की आवश्यकता है?

नहीं, MuAPI पर एक ही कुंजी से सीधा एक्सेस मिलता है।

क्या व्यावसायिक उपयोग अनुमत है?

हाँ, सभी जनरेट की गई संपत्तियां व्यावसायिक रूप से उपयोग की जा सकती हैं।

Google AI मॉडल के साथ निर्माण करें

Veo, Imagen और Gemini एंडपॉइंट्स को मिनटों में एकीकृत करें।