GPT-5.4 提供强大的推理、编程和专业知识工作能力。支持带有可调节推理深度的多模态输入(文本和图像)。按 token 计费:输入 token 每百万 $1.25,输出 token 每百万 $9.00。通过 SSE 提供两个端点:标准异步(/gpt-5-4)和实时流式(/gpt-5-4/stream)。
关于此模型
GPT-5.4 是 OpenAI 最新的旗舰模型,可提供强大的推理、编程和专业知识工作能力。它支持多模态输入(文本和图像)以及可调节的推理深度。按 token 计费:输入 token 每百万 $1.25,输出 token 每百万 $9.00,价格远低于 OpenAI 官方定价。
成本分析
| 提供商 | 费用 | 备注 |
|---|---|---|
| muapiapp | $1.25/M 输入 Token, $9.00/M 输出 Token | Token-based billing. Minimum $0.00023 per call. ~71% of official input 定价, ~64% of official output 定价. Supports Prompt Caching (0.1x for hits, 1.25x for creation). |
| OpenAI (official) | ~$1.75/M 输入 Token, ~$14.00/M 输出 Token | 价格以 api.openai.com 的官方定价为准。 |
| Fal.ai | 暂不可用 | GPT-5.4 is 不可用 on Fal.ai. |
Token-based billing. Minimum $0.00023 per call. ~71% of official input 定价, ~64% of official output 定价. Supports Prompt Caching (0.1x for hits, 1.25x for creation).
价格以 api.openai.com 的官方定价为准。
GPT-5.4 is 不可用 on Fal.ai.
** 竞品价格根据相似模型架构和使用层级估算。
配置参数
| 参数 | 类型 | 描述 | 默认值 |
|---|---|---|---|
| 提示词 | string | 用户消息或指令。 | Write a Python function to parse nested JSON with error handling. |
| 图像 URL | string | 多模态请求的可选图像 URL。 | undefined |
用户消息或指令。
Write a Python function to parse nested JSON with error handling.多模态请求的可选图像 URL。
undefined开发者文档
POST /api/v1/gpt-5-4 — 返回 request_id,通过 /api/v1/predictions/{id}/result 轮询结果。
POST /api/v1/gpt-5-4/stream — 返回实时 SSE 流。每个分块格式为:data: {"choices":[{"delta":{"content":"text"}}]},最后以 data: [DONE] 结束。
参见流式文档获取完整代码示例。
常见问答
按 token 计费:输入 token 每百万 $1.25,输出 token 每百万 $9.00。每次调用的最低费用为 $0.00023。实际费用会根据模型返回的 token 数量,在每次调用后扣除。
`/gpt-5-4` 是异步端点——你会收到一个 request_id,然后轮询结果。`/gpt-5-4/stream` 返回实时 SSE 流。聊天 UI 应使用流式端点;工作流和自动化应使用异步端点。
支持。在请求正文中传入 image_url,即可将图像与文本提示词一起作为多模态输入。
支持。Prompt Caching 允许你以更低费率重复使用常用文本提示词。缓存命中(重复使用先前缓存的 token)按输入成本的 0.1x 计费。新建缓存(将新 token 写入缓存以供未来重复使用)按标准输入成本的 1.25x 计费。