Gemini 2.5 Flash: AI Large Language Models

Gemini 2.5 Flash 是 Google 的高速多模态语言模型,针对快速文本生成、实时图像理解和高频任务进行了优化。支持文本和图像Entrada。按 token 计费:Entrada每百万 token $0.30,Saída每百万 token $2.50。提供两个端点:标准异步端点 (/gemini-2-5-flash) 和通过 SSE 提供实时流式传输的端点 (/gemini-2-5-flash/stream)。

📝

Overview

About this model

Gemini 2.5 Flash 是 Google 的高速多模态语言模型,针对快速文本生成、实时图像理解和高频任务进行了优化。价格为Entrada每百万 token $0.30,Saída每百万 token $2.50。

1高速对话:运行快速、交互式的对话式界面。
2实时分析:处理流式文本并总结传入的信息流。
3图像理解:快速为图像Entrada添加说明、分类或描述。
4简单编程任务:生成快速代码片段、辅助函数和脚本。
💰

Pricing & Value

Cost analysis

muapiapp$0.30/M input tokens, $2.50/M output tokens

按 Token 计费,每次调用最低 $0.00005,专为规模化使用而设计。

Fal.ai$0.40/M input tokens, $3.00/M output tokens

Muapi continua sendo mais econômico.

Replicate$0.42/M input tokens, $3.10/M output tokens

Muapi continua sendo mais econômico.

** Competitor pricing is estimated based on similar model architectures and usage tiers.

⚙️

Technical Details

Configuration schema

Promptstring

提供给模型的用户消息或指令。

Default ValueExplain quantum computing in simple terms.
Imagem URLstring

作为多模态Entrada的可选Imagem URL。

Default Valueundefined
系统Promptstring

可选的系统级指令,用于引导模型行为。

Default ValueYou are a helpful physics teacher.
📖

Implementation Guide

Developer documentation

标准(异步)

POST /api/v1/gemini-2-5-flash — 返回 request_id,通过 /api/v1/predictions/{id}/result 轮询结果。

流式传输(SSE)

POST /api/v1/gemini-2-5-flash/stream — 返回实时 SSE 流。每个数据块:data: {"choices":[{"delta":{"content":"text"}}]},以 data: [DONE] 结束。

详见流式传输文档获取完整代码示例。

Common Questions

Frequently asked

如何计算价格?

价格按 token 计算:Entrada每百万 token $0.30,Saída每百万 token $2.50。每次调用的最低收费为 $0.00005。实际费用会根据模型返回的 token 数量在每次调用后扣除。

Gemini 2.5 Flash 支持图像吗?

支持。将 image_url 传入请求体,即可在用户消息中包含图像。

Gemini 2.5 Flash 支持系统Prompt吗?

支持。你可以提供可选的 system_prompt 字段,用于引导模型的行为和语气。