GPT-5.6 是 OpenAI 在 2026 年 6 月的前沿发布——也是该公司首次把一次旗舰发布拆成一个清晰分档的家族,包含三个模型:Sol,面向最难问题的旗舰;Terra,面向日常生产工作的均衡型;以及 Luna,面向高并发任务的快速、低成本选项。命名是刻意为之的(太阳、地球、月亮),策略亦然:不再是一个模型、一种价格,GPT-5.6 让你把每个任务路由到仍能胜任的最便宜档位。
GPT-5.6 最初于 6 月 26 日以限量预览形式面向约 20 家经审核合作伙伴发布。2026 年 7 月 9 日,三个档位全面上线(GA),覆盖 ChatGPT、Codex 和 OpenAI API。API 模型别名 gpt-5.6 路由至 Sol;Terra 和 Luna 分别使用 gpt-5.6-terra 和 gpt-5.6-luna。上下文窗口为 1.05M 输入 / 128K 输出,知识截止 2026 年 2 月。

GPT-5.6 家族:Sol、Terra、Luna
每个档位瞄准成本/能力曲线上的不同位置。价格为每 100 万 token(输入 / 输出)。
| 档位 | 定位 | 价格(输入 / 输出) | 适用场景 |
|---|---|---|---|
| Sol | 旗舰——最难问题 | $5.00 / $30.00 | 复杂编码、网络安全、生物学、长时运行的智能体 |
| Terra | 均衡——日常生产 | $2.50 / $15.00 | 高并发的客服、内部工具、文档分析 |
| Luna | 快速且实惠 | $1.00 / $6.00 | 摘要、起草、常规自动化、兜底路由 |
OpenAI 将 Terra 定位为以约一半价格达到 GPT-5.5 级质量,并将 Luna 定位为在多项测试上接近 GPT-5.5、同时是最便宜的 GPT-5.x 档位——即使还没算上 Sol 的亮眼成绩,这已经在性价比前沿上形成了明显的拉力。
定价与缓存
旗舰 Sol 守住了 GPT-5.5 的价格(每 100 万 token $5 / $30),所以这里的成本看点是 Terra 与 Luna 带来的下行压力,而非更贵的顶档。作为参照,Sol 的价格约为 Anthropic Claude Fable 5($10 / $50)的一半。
OpenAI 还改进了 prompt 缓存,这对反复发送大段 prompt 的长上下文与智能体工作负载最为关键:
- 缓存写入按输入价的 1.25× 计费
- 最短缓存有效期 30 分钟
- 缓存读取费用立减 90%
一如既往,输出成本主导着智能体预算——在向客户报价前,请用有代表性的真实流量测试每个档位,因为按路由计费可能与预览的标称价不同。
基准测试:OpenAI 已公布的内容
最清晰的已公布数据来自 TerminalBench 2.1(一个命令行自动化基准):
| 模型 / 模式 | TerminalBench 2.1 |
|---|---|
| GPT-5.6 Sol — ultra | 91.91% |
| GPT-5.6 Sol — max | 88.76% |
| Claude Mythos 5 | 88% |
| GPT-5.5 | 83.4% |
几点实话提醒:这些是 OpenAI 在预览期间收集的自报数据,91.91% 的纪录用的是 Sol 最贵的 ultra 模式,而单一基准从来无法定论「哪个模型最好」。据称 Terra 在该 harness 上也胜过 GPT-5.5 基线。在独立评测出炉前,请把其余测试集当作未确认。想了解更中立、更全面的前沿格局,参见我们的 2026 LLM 全景指南。
Sol 的新模式:max 与 ultra
Sol 引入了两种以 token 和延迟换取深度的更高算力模式:
- max —— 面向最难的单个问题的更深单模型推理。
- ultra —— 协调子智能体,让 Sol 拆解复杂任务并分头处理。这正是刷新 TerminalBench 2.1 纪录背后的模式。
两种模式的单任务成本都更高,所以实用套路与其他前沿模型一致:用 Terra 或默认 Sol 跑工作流的大头,只在可靠性值回票价的步骤上升级到 max/ultra。
可用性与政府预览
GPT-5.6 于 2026 年 6 月 26 日通过 API 与 Codex 以限量预览形式发布,仅限一小群受信任的合作伙伴(约 20 家机构),其参与情况已向美国政府报备。这种分阶段放行源于 2026 年 6 月 2 日的一项行政令,要求联邦机构在广泛发布前建立新模型评估流程——一个约 30 天的窗口(到约 7 月 2 日),在发布时仍在进行中。
OpenAI 照做了,但在自己的公告中公开表达了异议,称它并不认为这类政府访问流程应成为长期默认做法,因为这「会让最好的工具远离真正需要它们的用户、开发者、企业、网络防御者与全球合作伙伴」。另外,OpenAI 表示将在 7 月于 Cerebras 硬件上以最高约 750 token/秒提供 Sol,初期面向部分客户。
横向对比
- 对比 GPT-5.5: GPT-5.6 是其直接继任者。Sol 在与 5.5 持平的价格上把智能体/终端成绩推得更高;更大的变化是 Terra 与 Luna 在日常与高并发工作上以更低价格压过 5.5。
- 对比 Claude Opus 4.8: Anthropic 的前沿在多项最难的推理与 SWE 分项上仍然领先;GPT-5.6 则以终端原生智能体和更便宜的中/低档位反击。投产某个工作负载前请逐项核对具体分项。
- 对比 Gemini 3.1 Pro: Gemini 凭借极低的输入价格仍是性价比/多模态之选;GPT-5.6 Luna 则在 OpenAI 产品线底端缩小了成本差距。
2026 年 8 月更新
Sol 改进与 Luna 面向免费用户(8 月 6 日)
OpenAI 更新了 ChatGPT 中的 GPT-5.6 Sol,改进了事实准确性并新增推理深度滑块,Plus/Pro 用户可控制 Sol 对每个回复投入多少思考。
GPT-5.6 Luna 成为免费用户的默认模型,提供无限文本对话。新增 Think 按钮让免费用户在较难问题上获取更深层推理(受滥用防护限制)。文件上传、图片等工具仍有限额。
GPT-5.6-Cyber(8 月 10 日)
OpenAI 发布了 GPT-5.6-Cyber,一个面向高级网络安全任务的 Sol 微调版。在 OpenAI 内部 Advanced Cybersecurity Completion Rate 基准上,Cyber 达 95%——相比 GPT-5.5-Cyber 的 57.3% 和标准 GPT-5.6 Sol(开启安全防护)的 1.5%。访问限审核合格的安全厂商和研究人员,属 Daybreak 计划的一部分。
仍待确认的内容
截至 2026 年 8 月 11 日,我们尚未见到以下官方数据:
- 完整的多模态 I/O —— GPT-5.5 原生为全模态(输入文本、图像、音频与视频);5.6 发布聚焦编码、网络安全与生物学,未详述模态支持。
- 除上面 TerminalBench 2.1 数据之外的完整基准测试集。
适用场景
- Sol:长跨度编码智能体、网络安全与生物学研究
- Terra:高并发业务工作——客服、内部工具、文档分析
- Luna:快速、低成本的日常任务——摘要、起草、常规自动化
优缺点
优势
- 分档家族(Sol / Terra / Luna)让你按任务难度匹配模型成本
- Sol 全新的「ultra」子智能体模式刷新 TerminalBench 2.1 纪录(91.91%,OpenAI 自报)
- Terra 以约一半的价格达到 GPT-5.5 级质量;Luna 是最便宜的 GPT-5.x,$1/$6
- 改进的 prompt 缓存(写入 1.25×、最短缓存 30 分钟、读取立减 90%)
局限
- 上下文窗口 1.05M 输入 / 128K 输出,但知识截止 2026 年 2 月——GA 时已过去五个月
- SWE-bench Pro(64.6%)落后 Claude Fable 5(80.3%)和 Opus 5(79.2%)约 15 分
- Sol 的亮眼成绩依赖其最贵的 max / ultra 模式(更多 token、更高延迟)
- 推出节奏受美国政府的分阶段放行流程限制
常见问题
GPT-5.6 对所有人开放了吗?
是的。GPT-5.6 于 2026 年 7 月 9 日全面上线(GA),此前经历了 6 月 26 日起约 20 家审核伙伴的限量预览。三个档位——Sol、Terra、Luna——均可通过 OpenAI API、ChatGPT(付费方案)和 Codex 使用。API 别名 `gpt-5.6` 路由到 Sol。
Sol、Terra 与 Luna 是什么?
它们是 GPT-5.6 家族的三个档位。Sol 是面向最难问题(复杂编码、安全、生物学)的旗舰;Terra 是面向高并发业务任务的均衡型;Luna 则是面向日常工作的快速、低成本选项。三者的输入/输出价格分别为每 100 万 token $5/$30、$2.50/$15 与 $1/$6。
Sol 的「max」与「ultra」模式是什么?
Sol 新增两种更高算力投入的模式——「max」用于更深的单模型推理,「ultra」用于在复杂任务上协调子智能体。OpenAI 自报 ultra 在 TerminalBench 2.1 上达到 91.91%、max 达到 88.76%,而 GPT-5.5 为 83.4%。这两种模式消耗更多 token 并增加延迟,建议只在最难的步骤上启用。
GPT-5.6 与 GPT-5.5 的定价相比如何?
旗舰 Sol 与 GPT-5.5 价格相同(输入 $5 / 输出 $30,每 100 万 token)。真正的变化在于下探——Terra 以约一半的价格($2.50/$15)提供 GPT-5.5 级质量,Luna 在多项测试上接近 GPT-5.5,价格为 $1/$6,是最便宜的 GPT-5.x 档位。
为什么推出范围受限?
OpenAI 称已就这些模型与发布计划向美国政府做了预览,并应政府要求,先以有限的合作伙伴预览开始,再进行更广泛的发布。此举源于 2026 年 6 月 2 日一项关于评估新 AI 模型的行政令。OpenAI 公开表示,它并不认为这类政府访问流程应成为长期默认做法。