模型简介
GPT-5.6 Luna 是 GPT-5.6 系列面向成本敏感和高请求量场景的高效档位,保留长上下文、推理控制与代理工具能力。
模型能力
规格来自已列明的模型资料;目录标签用于快速判断接入能力,精确限制以来源文档为准。
已核验规格
- 官方定位
- 成本敏感、高请求量工作负载
- 上下文窗口
- 1,050,000 tokens
- 最大输出
- 128,000 tokens
- 知识截止
- 2026-02-16
- 输入 / 输出
- 文本、图像 / 文本
资料来源: OpenAI GPT-5.6 Luna 模型文档
模型价格和接入方式
价格直接读取 MoleAPI 控制台目录,并按当前计费分组与上下文档位展示。
实际结算价格以控制台中的账户分组为准。
实时价格来源
价格表
USD / 1M tokens标准x1default输入 $0.2 · 输出 $1.2
standard长度 ≤ 272K
- 输入
- $0.2/ 1M
- 输出
- $1.2/ 1M
- 缓存读取
- $0.02/ 1M
- 缓存写入
- $0.25/ 1M
- 图像输入
- -
- 图像输出
- -
long_context- 输入
- $0.4/ 1M
- 输出
- $1.8/ 1M
- 缓存读取
- $0.04/ 1M
- 缓存写入
- $0.5/ 1M
- 图像输入
- $8/ 1M
- 图像输出
- $30/ 1M
特价x0.8discount输入 $0.16 · 输出 $0.96
standard长度 ≤ 272K
- 输入
- $0.16/ 1M
- 输出
- $0.96/ 1M
- 缓存读取
- $0.016/ 1M
- 缓存写入
- $0.2/ 1M
- 图像输入
- -
- 图像输出
- -
long_context- 输入
- $0.32/ 1M
- 输出
- $1.44/ 1M
- 缓存读取
- $0.032/ 1M
- 缓存写入
- $0.4/ 1M
- 图像输入
- $6.4/ 1M
- 图像输出
- $24/ 1M
转接x0.3relay输入 $0.06 · 输出 $0.36
standard长度 ≤ 272K
- 输入
- $0.06/ 1M
- 输出
- $0.36/ 1M
- 缓存读取
- $0.006/ 1M
- 缓存写入
- $0.075/ 1M
- 图像输入
- -
- 图像输出
- -
long_context- 输入
- $0.12/ 1M
- 输出
- $0.54/ 1M
- 缓存读取
- $0.012/ 1M
- 缓存写入
- $0.15/ 1M
- 图像输入
- $2.4/ 1M
- 图像输出
- $9/ 1M
临时(可用性随缘)x0.1temp输入 $0.02 · 输出 $0.12
standard长度 ≤ 272K
- 输入
- $0.02/ 1M
- 输出
- $0.12/ 1M
- 缓存读取
- $0.002/ 1M
- 缓存写入
- $0.025/ 1M
- 图像输入
- -
- 图像输出
- -
long_context- 输入
- $0.04/ 1M
- 输出
- $0.18/ 1M
- 缓存读取
- $0.004/ 1M
- 缓存写入
- $0.05/ 1M
- 图像输入
- $0.8/ 1M
- 图像输出
- $3/ 1M
接入协议
可用计费分组: 标准, 特价, 转接, 临时(可用性随缘)
- openai
- POST
- /v1/chat/completions
- openai-response
- POST
- /v1/responses
- anthropic
- POST
- /v1/messages
- gemini
- POST
- /v1beta/models/{model}:generateContent
- image-generation
- POST
- /v1/images/generations
- openai-response-compact
- POST
- /v1/responses/compact
- openai-alpha-search
- POST
- /v1/alpha/search
完整模型指南
基于厂商资料整理,并经过独立审稿。 · 2026-07-28
GPT-5.6 Luna 是 OpenAI GPT-5.6 模型家族中定位最具成本效率的型号;同一系列还包括旗舰型号 Sol 和面向日常工作的均衡型 Terra,现已正式可用。 [6]
模型定位与核心能力
GPT-5.6 Luna 是 GPT-5.6 家族的成本效率档位,面向对规模化处理效率有要求的工作负载。 [6]
GPT-5.6 家族支持 Programmatic Tool Calling,可在 Responses API 中编写和运行轻量程序,协调工具调用与处理中间结果,减少模型与工具之间的往返。 [6]
能力与规格
OpenAI 将 Luna 定位为 GPT-5.6 家族中最具成本效率的模型,与 Sol 的旗舰定位及 Terra 的日常均衡定位形成分层。 [6]
第三方资料列出 Luna 支持多档推理强度,以及函数调用、网页搜索、文件搜索、计算机使用和持久化推理等工作流能力。 [2]
使用场景
Luna 面向摘要、改写、分类、信息抽取、路由和轻量分析等高容量文本处理任务。 [2]
其适用范围还包括面向用户的助手、常规自动化、工作流辅助、初步问题分诊、代码审查草稿、测试用例生成与文档分析。 [2]
重要限制
Luna 是 GPT-5.6 家族的成本效率层级;资料将困难案例归为可升级至 Terra 或 Sol 处理的范围。 [2]
较高推理强度、Pro 模式、多智能体工作流与长上下文处理会增加延迟和成本。 [2]
来源
[6] GPT-5.6: Frontier intelligence that scales with your ambition
代码示例
示例使用 MoleAPI 的 Responses API 地址;替换 API Key 后即可运行。
curl https://api.moleapi.com/v1/responses \
-H "Authorization: Bearer $MOLEAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-luna",
"input": "Explain this problem step by step."
}'常见问题
gpt-5.6-luna 怎么计费?
本页价格从 MoleAPI 控制台接口动态读取,并随模型价格、上下文档位和账户分组更新。
gpt-5.6-luna 支持哪些接入方式?
本页协议和接口来自 MoleAPI 模型目录的 supported_endpoint_types 字段。
如何在现有项目中切换到 gpt-5.6-luna?
保留 MoleAPI 的 API 地址和密钥,把请求中的 model 参数替换为本页模型 ID;再按照对应协议检查参数差异。
gpt-5.6-luna 的模型资料来自哪里?
模型能力与限制已根据 OpenAI 等页面核验;价格和可用协议只采用 MoleAPI 控制台数据。