Gemini 2.5 Flash 是 Google 的高速多模态语言模型,针对快速文本生成、实时图像理解和高频任务进行了优化。支持文本和图像输入。按 token 计费:输入每百万 token $0.30,输出每百万 token $2.50。提供两个端点:标准异步端点 (/gemini-2-5-flash) 和通过 SSE 提供实时流式传输的端点 (/gemini-2-5-flash/stream)。
关于此模型
Gemini 2.5 Flash 是 Google 的高速多模态语言模型,针对快速文本生成、实时图像理解和高频任务进行了优化。价格为输入每百万 token $0.30,输出每百万 token $2.50。
成本分析
| 提供商 | 费用 | 备注 |
|---|---|---|
| muapiapp | $0.30/M 输入 Token, $2.50/M 输出 Token | 按 Token 计费,每次调用最低 $0.00005,专为规模化使用而设计。 |
| Fal.ai | $0.40/M 输入 Token, $3.00/M 输出 Token | muapiapp 仍然更具性价比。 |
| Replicate | $0.42/M 输入 Token, $3.10/M 输出 Token | muapiapp 仍然更具性价比。 |
按 Token 计费,每次调用最低 $0.00005,专为规模化使用而设计。
muapiapp 仍然更具性价比。
muapiapp 仍然更具性价比。
** 竞品价格根据相似模型架构和使用层级估算。
配置参数
| 参数 | 类型 | 描述 | 默认值 |
|---|---|---|---|
| 提示词 | string | 提供给模型的用户消息或指令。 | Explain quantum computing in simple terms. |
| 图像 URL | string | 作为多模态输入的可选图像 URL。 | undefined |
| 系统提示词 | string | 可选的系统级指令,用于引导模型行为。 | You are a helpful physics teacher. |
提供给模型的用户消息或指令。
Explain quantum computing in simple terms.作为多模态输入的可选图像 URL。
undefined可选的系统级指令,用于引导模型行为。
You are a helpful physics teacher.开发者文档
POST /api/v1/gemini-2-5-flash — 返回 request_id,通过 /api/v1/predictions/{id}/result 轮询结果。
POST /api/v1/gemini-2-5-flash/stream — 返回实时 SSE 流。每个数据块:data: {"choices":[{"delta":{"content":"text"}}]},以 data: [DONE] 结束。
详见流式传输文档获取完整代码示例。
常见问答
价格按 token 计算:输入每百万 token $0.30,输出每百万 token $2.50。每次调用的最低收费为 $0.00005。实际费用会根据模型返回的 token 数量在每次调用后扣除。
支持。将 image_url 传入请求体,即可在用户消息中包含图像。
支持。你可以提供可选的 system_prompt 字段,用于引导模型的行为和语气。