OpenAI GPT 5.6 Luna: AI Large Language Models

使用 OpenAI GPT 5.6 Luna 快速生成文本。适合分类和筛查的高性价比多模态推理。无需订阅。

📝

Overview

About this model

GPT 5.6 Luna 是 OpenAI GPT 5.6 多模态推理系列中速度快、成本高效的成员,针对高吞吐、低延迟工作负载进行了优化。它接受混合文本和图像entrada,支持用于引导行为的系统prompt,并可调用集成的网页搜索工具获取实时信息。通过 reasoning_effort 参数可以调整推理深度,从而按请求在延迟和完整性之间进行权衡。对于需要大规模运行、又不希望承担更大型 TerraSol 模型成本的自动分类、内容筛查和简单提取工作流,Luna 是理想的起点。

1高吞吐自动化:以较低的单次调用成本,快速运行大批量分类、审核和筛查任务。
2简单提取:从非结构化文本或扫描文档中提取结构化字段(姓名、日期、类别)。
3聊天机器人分流:在升级到更大型模型之前,将收到的支持消息或工单路由到正确队列。
4快速多模态查询:无需大量推理开销,即可回答关于上传图像的直接问题。
💰

Pricing & Value

Cost analysis

muapiapp$2.00/M input, $12.00/M output

按 Token 计费,每次调用最低 $0.0002。

Fal.aiNo disponible

目前没有专用的 GPT 5.6 Luna 端点。

ReplicateNo disponible

目前没有专用的 GPT 5.6 Luna 端点。

** Competitor pricing is estimated based on similar model architectures and usage tiers.

⚙️

Technical Details

Configuration schema

Promptstring

用户消息或指令。

Default ValueSummarize this article in three bullet points.
Imagen URLstring

多模态请求的可选imagen URL。

Default Valueundefined
系统Promptstring

可选的系统级指令,用于引导模型行为。

Default ValueYou are an expert tutor.
网页搜索开关boolean

启用网页搜索工具以获取实时信息。

Default Valuefalse
推理FuerzaEnum (4 options)

推理深度级别:low、medium、high 或 xhigh。

Default Valuelow
📖

Implementation Guide

Developer documentation

标准(异步)

POST /api/v1/gpt-5-6-luna——返回 request_id,通过 /api/v1/predictions/{id}/result 轮询结果。

流式传输(SSE)

POST /api/v1/gpt-5-6-luna/stream——返回实时 Server-Sent Events 流(Content-Type: text/event-stream)。每个数据块的格式为 data: {"choices":[{"delta":{"content":"text"}}]},最后以 data: [DONE] 结束。

cURL 示例

curl -X POST "https://api.muapi.ai/api/v1/gpt-5-6-luna" \
  -H "Authorization: Bearer $YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "prompt": "将此支持工单分类为计费、技术或一般问题。",
    "reasoning_effort": "low"
  }'

Common Questions

Frequently asked

GPT 5.6 Luna 最适合用于什么?

Luna 针对速度和效率进行了优化,非常适合大批量自动分类、筛查和简单提取任务,尤其适合低延迟和成本比深度推理更重要的场景。

GPT 5.6 Luna 如何计算价格?

按 token 计费:entrada token 为每百万 $2.00,salida token 为每百万 $12.00,每次调用最低收费 $0.0002。

GPT 5.6 Luna 支持多模态entrada吗?

支持,Luna 支持在单条消息中混合使用文本和图像(`image_url`)entrada。

什么是推理强度控制?

你可以传入 `reasoning_effort` 值 'low'、'medium'、'high' 或 'xhigh' 来控制推理深度。级别越高,逻辑越全面,但延迟也会增加;为了获得最高速度,Luna 通常以 'low' 运行。

如何在异步和流式端点之间进行选择?

对于用户期待实时反馈的交互式聊天界面,请使用流式端点(/gpt-5-6-luna/stream)。对于后台任务、工作流和自动化脚本,请使用异步端点(/gpt-5-6-luna)。

什么时候应该从 Luna 升级到 Terra 或 Sol?

对于均衡的商业和分析任务,请升级到 Terra;对于复杂数学、编程和科学推理,如果 Luna 经过速度优化的回答不够全面,请升级到 Sol。