Gemini 2.5 Flash: AI 大语言模型

Gemini 2.5 Flash 是 Google 的高速多模态语言模型,针对快速文本生成、实时图像理解和高频任务进行了优化。支持文本和图像输入。按 token 计费:输入每百万 token $0.30,输出每百万 token $2.50。提供两个端点:标准异步端点 (/gemini-2-5-flash) 和通过 SSE 提供实时流式传输的端点 (/gemini-2-5-flash/stream)。

📝

概览

关于此模型

Gemini 2.5 Flash 是 Google 的高速多模态语言模型,针对快速文本生成、实时图像理解和高频任务进行了优化。价格为输入每百万 token $0.30,输出每百万 token $2.50。

1高速对话:运行快速、交互式的对话式界面。
2实时分析:处理流式文本并总结传入的信息流。
3图像理解:快速为图像输入添加说明、分类或描述。
4简单编程任务:生成快速代码片段、辅助函数和脚本。
💰

价格与价值

成本分析

muapiapp$0.30/M 输入 Token, $2.50/M 输出 Token

按 Token 计费,每次调用最低 $0.00005,专为规模化使用而设计。

Fal.ai$0.40/M 输入 Token, $3.00/M 输出 Token

muapiapp 仍然更具性价比。

Replicate$0.42/M 输入 Token, $3.10/M 输出 Token

muapiapp 仍然更具性价比。

** 竞品价格根据相似模型架构和使用层级估算。

⚙️

技术详情

配置参数

提示词string

提供给模型的用户消息或指令。

默认值Explain quantum computing in simple terms.
图像 URLstring

作为多模态输入的可选图像 URL。

默认值undefined
系统提示词string

可选的系统级指令,用于引导模型行为。

默认值You are a helpful physics teacher.
📖

实施指南

开发者文档

标准(异步)

POST /api/v1/gemini-2-5-flash — 返回 request_id,通过 /api/v1/predictions/{id}/result 轮询结果。

流式传输(SSE)

POST /api/v1/gemini-2-5-flash/stream — 返回实时 SSE 流。每个数据块:data: {"choices":[{"delta":{"content":"text"}}]},以 data: [DONE] 结束。

详见流式传输文档获取完整代码示例。

常见问题

常见问答

如何计算价格?

价格按 token 计算:输入每百万 token $0.30,输出每百万 token $2.50。每次调用的最低收费为 $0.00005。实际费用会根据模型返回的 token 数量在每次调用后扣除。

Gemini 2.5 Flash 支持图像吗?

支持。将 image_url 传入请求体,即可在用户消息中包含图像。

Gemini 2.5 Flash 支持系统提示词吗?

支持。你可以提供可选的 system_prompt 字段,用于引导模型的行为和语气。