OpenAI

gpt-5.6-luna

模型 IDgpt-5.6-luna

接入文档Markdown

模型简介

GPT-5.6 Luna 是 GPT-5.6 系列面向成本敏感和高请求量场景的高效档位,保留长上下文、推理控制与代理工具能力。

模型能力

规格来自已列明的模型资料;目录标签用于快速判断接入能力,精确限制以来源文档为准。

OpenAI 兼容Responses APIAnthropic 兼容Gemini 兼容图像生成视觉提示词缓存推理

已核验规格

官方定位
成本敏感、高请求量工作负载
上下文窗口
1,050,000 tokens
最大输出
128,000 tokens
知识截止
2026-02-16
输入 / 输出
文本、图像 / 文本

资料来源: OpenAI GPT-5.6 Luna 模型文档

模型价格和接入方式

价格直接读取 MoleAPI 控制台目录,并按当前计费分组与上下文档位展示。

实际结算价格以控制台中的账户分组为准。
实时价格来源

价格表

USD / 1M tokens
标准x1default输入 $0.2 · 输出 $1.2
standard

长度 ≤ 272K

输入
$0.2/ 1M
输出
$1.2/ 1M
缓存读取
$0.02/ 1M
缓存写入
$0.25/ 1M
图像输入
-
图像输出
-
long_context
输入
$0.4/ 1M
输出
$1.8/ 1M
缓存读取
$0.04/ 1M
缓存写入
$0.5/ 1M
图像输入
$8/ 1M
图像输出
$30/ 1M
特价x0.8discount输入 $0.16 · 输出 $0.96
standard

长度 ≤ 272K

输入
$0.16/ 1M
输出
$0.96/ 1M
缓存读取
$0.016/ 1M
缓存写入
$0.2/ 1M
图像输入
-
图像输出
-
long_context
输入
$0.32/ 1M
输出
$1.44/ 1M
缓存读取
$0.032/ 1M
缓存写入
$0.4/ 1M
图像输入
$6.4/ 1M
图像输出
$24/ 1M
转接x0.3relay输入 $0.06 · 输出 $0.36
standard

长度 ≤ 272K

输入
$0.06/ 1M
输出
$0.36/ 1M
缓存读取
$0.006/ 1M
缓存写入
$0.075/ 1M
图像输入
-
图像输出
-
long_context
输入
$0.12/ 1M
输出
$0.54/ 1M
缓存读取
$0.012/ 1M
缓存写入
$0.15/ 1M
图像输入
$2.4/ 1M
图像输出
$9/ 1M
临时(可用性随缘)x0.1temp输入 $0.02 · 输出 $0.12
standard

长度 ≤ 272K

输入
$0.02/ 1M
输出
$0.12/ 1M
缓存读取
$0.002/ 1M
缓存写入
$0.025/ 1M
图像输入
-
图像输出
-
long_context
输入
$0.04/ 1M
输出
$0.18/ 1M
缓存读取
$0.004/ 1M
缓存写入
$0.05/ 1M
图像输入
$0.8/ 1M
图像输出
$3/ 1M

接入协议

可用计费分组: 标准, 特价, 转接, 临时(可用性随缘)

openai
POST
/v1/chat/completions
openai-response
POST
/v1/responses
anthropic
POST
/v1/messages
gemini
POST
/v1beta/models/{model}:generateContent
image-generation
POST
/v1/images/generations
openai-response-compact
POST
/v1/responses/compact
openai-alpha-search
POST
/v1/alpha/search

完整模型指南

基于厂商资料整理,并经过独立审稿。 · 2026-07-28

GPT-5.6 Luna 是 OpenAI GPT-5.6 模型家族中定位最具成本效率的型号;同一系列还包括旗舰型号 Sol 和面向日常工作的均衡型 Terra,现已正式可用。 [6]

模型定位与核心能力

GPT-5.6 Luna 是 GPT-5.6 家族的成本效率档位,面向对规模化处理效率有要求的工作负载。 [6]

GPT-5.6 家族支持 Programmatic Tool Calling,可在 Responses API 中编写和运行轻量程序,协调工具调用与处理中间结果,减少模型与工具之间的往返。 [6]

能力与规格

OpenAI 将 Luna 定位为 GPT-5.6 家族中最具成本效率的模型,与 Sol 的旗舰定位及 Terra 的日常均衡定位形成分层。 [6]

第三方资料列出 Luna 支持多档推理强度,以及函数调用、网页搜索、文件搜索、计算机使用和持久化推理等工作流能力。 [2]

使用场景

Luna 面向摘要、改写、分类、信息抽取、路由和轻量分析等高容量文本处理任务。 [2]

其适用范围还包括面向用户的助手、常规自动化、工作流辅助、初步问题分诊、代码审查草稿、测试用例生成与文档分析。 [2]

重要限制

Luna 是 GPT-5.6 家族的成本效率层级;资料将困难案例归为可升级至 Terra 或 Sol 处理的范围。 [2]

较高推理强度、Pro 模式、多智能体工作流与长上下文处理会增加延迟和成本。 [2]

来源

[2] B.AI GPT-5.6 Luna 模型指南

[6] GPT-5.6: Frontier intelligence that scales with your ambition

代码示例

示例使用 MoleAPI 的 Responses API 地址;替换 API Key 后即可运行。

curl https://api.moleapi.com/v1/responses \
  -H "Authorization: Bearer $MOLEAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-luna",
    "input": "Explain this problem step by step."
  }'

常见问题

gpt-5.6-luna 怎么计费?

本页价格从 MoleAPI 控制台接口动态读取,并随模型价格、上下文档位和账户分组更新。

gpt-5.6-luna 支持哪些接入方式?

本页协议和接口来自 MoleAPI 模型目录的 supported_endpoint_types 字段。

如何在现有项目中切换到 gpt-5.6-luna?

保留 MoleAPI 的 API 地址和密钥,把请求中的 model 参数替换为本页模型 ID;再按照对应协议检查参数差异。

gpt-5.6-luna 的模型资料来自哪里?

模型能力与限制已根据 OpenAI 等页面核验;价格和可用协议只采用 MoleAPI 控制台数据。