关于此模型
成本分析
| 提供商 | 费用 | 备注 |
|---|---|---|
| muapiapp | $2.00/M 输入, $12.00/M 输出 | 按 Token 计费,每次调用最低 $0.0002。 |
| Fal.ai | 暂不可用 | 目前没有专用的 GPT 5.6 Luna 端点。 |
| Replicate | 暂不可用 | 目前没有专用的 GPT 5.6 Luna 端点。 |
按 Token 计费,每次调用最低 $0.0002。
目前没有专用的 GPT 5.6 Luna 端点。
目前没有专用的 GPT 5.6 Luna 端点。
** 竞品价格根据相似模型架构和使用层级估算。
配置参数
| 参数 | 类型 | 描述 | 默认值 |
|---|---|---|---|
| 提示词 | string | 用户消息或指令。 | Summarize this article in three bullet points. |
| 图像 URL | string | 多模态请求的可选图像 URL。 | undefined |
| 系统提示词 | string | 可选的系统级指令,用于引导模型行为。 | You are an expert tutor. |
| 网页搜索开关 | boolean | 启用网页搜索工具以获取实时信息。 | false |
| 推理强度 | 枚举(4 个选项) | 推理深度级别:low、medium、high 或 xhigh。 | low |
用户消息或指令。
Summarize this article in three bullet points.多模态请求的可选图像 URL。
undefined可选的系统级指令,用于引导模型行为。
You are an expert tutor.启用网页搜索工具以获取实时信息。
false推理深度级别:low、medium、high 或 xhigh。
low开发者文档
POST /api/v1/gpt-5-6-luna——返回 request_id,通过 /api/v1/predictions/{id}/result 轮询结果。
POST /api/v1/gpt-5-6-luna/stream——返回实时 Server-Sent Events 流(Content-Type: text/event-stream)。每个数据块的格式为 data: {"choices":[{"delta":{"content":"text"}}]},最后以 data: [DONE] 结束。
curl -X POST "https://api.muapi.ai/api/v1/gpt-5-6-luna" \
-H "Authorization: Bearer $YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"prompt": "将此支持工单分类为计费、技术或一般问题。",
"reasoning_effort": "low"
}'
常见问答
Luna 针对速度和效率进行了优化,非常适合大批量自动分类、筛查和简单提取任务,尤其适合低延迟和成本比深度推理更重要的场景。
按 token 计费:输入 token 为每百万 $2.00,输出 token 为每百万 $12.00,每次调用最低收费 $0.0002。
支持,Luna 支持在单条消息中混合使用文本和图像(`image_url`)输入。
你可以传入 `reasoning_effort` 值 'low'、'medium'、'high' 或 'xhigh' 来控制推理深度。级别越高,逻辑越全面,但延迟也会增加;为了获得最高速度,Luna 通常以 'low' 运行。
对于用户期待实时反馈的交互式聊天界面,请使用流式端点(/gpt-5-6-luna/stream)。对于后台任务、工作流和自动化脚本,请使用异步端点(/gpt-5-6-luna)。
对于均衡的商业和分析任务,请升级到 Terra;对于复杂数学、编程和科学推理,如果 Luna 经过速度优化的回答不够全面,请升级到 Sol。