Gemini 3.5 Flash (OpenAI): AI 大语言模型

Gemini 3.5 Flash(OpenAI 兼容版)是一款高速多模态语言模型,专为实时文本生成而构建,并原生支持文本和图像输入。按 token 计费:输入 token 每百万 $0.60,输出 token 每百万 $3.60。提供两个端点:标准异步(/gemini-3-5-flash-openai)和通过 SSE 的实时流式端点(/gemini-3-5-flash-openai/stream)。

📝

概览

关于此模型

Gemini 3.5 Flash(OpenAI 兼容版)是一款高速多模态语言模型,针对快速文本生成和实时图像理解进行了优化,可通过 OpenAI 兼容的 API 接口访问。按 token 计费:输入 token 每百万 $0.60,输出 token 每百万 $3.60。

1实时客服助手
2多模态图像分析和图像描述
3快速内容摘要和改写
4快速生成代码片段并调试
5通用对话式智能体
💰

价格与价值

成本分析

muapiapp$0.60/M 输入, $3.60/M 输出 Token

快速、高质量的 Token 计费,单次调用最低收费 $0.0001。

Google (official)$0.075/M 输入, $0.30/M 输出 Token (上下文低于 128k)

官方 API 定价。我们的费率与标准 Gemini 费率保持一致,并保留开发者所需的利润空间。

** 竞品价格根据相似模型架构和使用层级估算。

⚙️

技术详情

配置参数

提示词string

提供给模型的用户消息或指令。

默认值Summarize the key points of the attached image.
图像 URLstring

作为多模态输入的可选图像 URL。

默认值undefined
系统提示词string

可选的系统级指令,用于引导模型行为。

默认值You are a helpful assistant that responds concisely.
📖

实施指南

开发者文档

如何使用 Gemini 3.5 Flash (OpenAI)

  1. 准备提示词:在 prompt 字段中编写清晰的文本指令或问题。
  2. 加入图像(可选):如果需要分析图像,请在 image_url 字段中传入图像的直接 URL。
  3. 提供系统指令(可选):在 system_prompt 字段中传入系统级约束。
  4. 提交请求:将请求发送到 /gemini-3-5-flash-openai 端点进行异步处理,或使用 /gemini-3-5-flash-openai/stream 实时接收 token。

常见问题

常见问答

采用什么计费模式?

按 token 计费。输入 token 每百万收费 $0.60,输出 token 每百万收费 $3.60,每次调用预先收取的最低费用为 $0.0001。最终价格会根据实际 token 使用量在调用后调整。

Gemini 3.5 Flash (OpenAI) 支持流式传输吗?

支持。`/gemini-3-5-flash-openai/stream` 提供流式端点,使用 Server-Sent Events(SSE)实时传回 token 响应。