模型、研究与 Prompt ·
GPT 5.6 终于解禁:Sol、Terra、Luna,本周四一起上!
继 Anthropic 恢复 Fable 5 的全球访问后,OpenAI 这边也终于传来消息:GPT 5.6 Sol 将在本周四与 Terra、Luna 一起公开推出,预览访问正在向全球扩展。
来了来了,GPT-5.6 终于官宣“解禁”了。
继 Anthropic 恢复 Fable 5 的全球访问后,OpenAI 这边也终于传来消息:GPT-5.6 Sol 将在本周四与 Terra、Luna 一起公开推出,预览访问正在向全球扩展。

很多人,包括我,等这条消息已经等了挺久。
不过先说清楚:这里的“解禁”,并不等于现在打开 ChatGPT,所有人都已经能在模型列表里选到 GPT-5.6。
OpenAI 的最新口径是“本周四公开推出,并在全球扩大预览访问”。而截至发稿,官方帮助中心仍然保留着此前的预览说明:GPT-5.6 主要通过 API 和 Codex 向获批组织开放,ChatGPT 暂未包含在预览中。
所以更准确地说,这不是闸门已经完全消失,而是最后一道闸门终于开始往上抬了。
三个版本,一次全上
这次 OpenAI 没有只放出一款模型,而是直接把 GPT-5.6 做成了一个完整的产品梯队:
- Sol:旗舰款,也是这一代能力最强的模型;
- Terra:平衡款,主打日常工作和性价比;
- Luna:速度款,成本最低,适合高频、低延迟任务。
名字也挺有意思:太阳、地球、月亮,一家人算是到齐了。
但这三个版本并不只是“大杯、中杯、小杯”。OpenAI 给它们安排的,其实是三种不同的工作方式。
Sol 负责啃最难的任务,Terra 负责把能力和价格压到一个更实用的位置,Luna 则负责把模型真正塞进那些对速度和调用成本敏感的业务里。
按照 OpenAI 在首轮预览公告中的说法,Terra 的表现可以与 GPT-5.5 竞争,但成本只有后者的一半;Luna 则是 GPT-5.6 家族里最快、最便宜的版本。
这意味着 GPT-5.6 不只是来争“最强模型”这个头衔的。
它明显也在抢生产环境。
真正值得看的,是 Agent 能力
GPT-5.6 当然会有更强的推理、更好的代码能力,以及更长时间处理复杂问题的能力。
但我感觉,这次真正值得注意的不是它又在某张榜单上多了几分,而是 OpenAI 正在把“单个模型回答问题”,继续往“一个系统完成工作”上推。
GPT-5.6 新增了 Max reasoning effort。简单说,就是允许 Sol 在特别难的问题上投入更多推理时间,不急着交卷。
更有意思的是 Ultra 模式。
它不再只依赖一个 Agent 从头干到尾,而是会调用多个子 Agent 并行处理复杂任务。就像以前你是把事情交给一个能力很强的员工,现在则是直接给他配了一个小组:有人查资料,有人写代码,有人验证结果,最后再把答案收拢回来。
这也是为什么 OpenAI 重点展示的不是传统问答,而是终端操作、长流程科研和网络安全任务。
官方称,GPT-5.6 Sol 在考察命令行规划、迭代和工具协作的 Terminal-Bench 2.1 上刷新了最佳成绩;在长流程基因组学任务 GeneBench v1 上,它比 GPT-5.5 更强,同时消耗的 Token 更少;在漏洞研究和利用测试中,它也把能力与推理效率继续往前推了一截。
这些指标听起来有点硬,但翻译成人话其实就一句:
GPT-5.6 更像一个能持续干活的 Agent,而不只是一个更会聊天的模型。
哦对了,OpenAI 还计划在 7 月把 GPT-5.6 Sol 部署到 Cerebras,速度最高可达每秒 750 Token。不过首批仍然只面向部分客户,离所有人都能用还有一段距离。
价格比想象中克制
这次三款模型的 API 定价也已经给出来了,均按每百万 Token 计算:
| 模型 | 输入价格 | 输出价格 |
|---|---|---|
| GPT-5.6 Sol | 5 美元 | 30 美元 |
| GPT-5.6 Terra | 2.5 美元 | 15 美元 |
| GPT-5.6 Luna | 1 美元 | 6 美元 |
Sol 并不便宜,但也没有贵到只适合做演示。Terra 和 Luna 的意图则更明显:一个负责成为默认生产力模型,一个负责大规模调用。
OpenAI 还给 GPT-5.6 加入了更可预测的 Prompt Cache,支持显式缓存断点,并保证至少 30 分钟的缓存时间。缓存读取仍然可以享受 90% 的折扣。
对普通用户来说,这些词可能没什么感觉;但对每天要跑几百万、几千万 Token 的团队来说,缓存是否稳定,往往比模型便宜几毛钱更重要。
毕竟模型单次回答再惊艳,调用十万次之后,账单才是最诚实的 Benchmark。
为什么这次“解禁”这么受关注?
因为 GPT-5.6 从一开始就不只是一场普通的模型发布。
6 月 26 日,OpenAI 首次预览 GPT-5.6 时,只向一小部分可信合作伙伴和组织开放。官方明确提到,这种分阶段发布与美国政府的安全协调有关,尤其是模型在网络安全、生物与化学领域已经达到更高的能力等级。
差不多同一时期,Anthropic 的 Fable 5 也经历了先发布、再因出口管制暂停、最后重新向全球恢复访问的波折。
所以你会发现,2026 年的前沿模型竞争,已经不只是“谁的分数更高”。
还有一个越来越现实的问题:一个模型再强,如果普通用户和开发者拿不到,它的能力就只存在于发布会和评测表里。
从这个角度看,今天真正重要的并不是 GPT-5.6 又赢了哪张榜单,而是前沿能力开始重新走向更广泛的用户。
但能力越强,越要盯住它的手
当然,更强的 Agent 也会带来新的麻烦。
OpenAI 在 GPT-5.6 的系统卡里很坦率地提到:在内部模拟中,Sol 相比 GPT-5.5 更容易“过度积极”地追求目标,有时会把用户没有明确授权的事情也一起做了。
这其实是 Agent 时代一个很典型的问题。
以前的模型犯错,可能只是答错一句话;现在的模型能打开终端、修改文件、调用工具、操作外部系统,犯错就可能真的改变现实世界里的东西。
能力强不是问题,自作主张才是。
所以 GPT-5.6 到底好不好用,我最想看的反而不是发布页上的峰值成绩,而是它在真实工作里能不能做到三件事:
第一,长任务做完之后,结果到底靠不靠谱;
第二,遇到边界不清楚的操作,会不会先停下来问一句;
第三,Ultra 模式调来一群子 Agent 之后,效率提升能不能覆盖额外的时间和 Token 成本。
这些问题,榜单暂时都回答不了。
最后
不管怎么说,GPT-5.6 这次终于不是只能远远围观了。
Sol、Terra、Luna 一起上,全球预览开始扩展,OpenAI 和 Anthropic 的新一代旗舰模型也终于重新回到同一张牌桌上。
接下来真正有意思的,不是谁在海报上写下“最强”,而是谁能把这些强得有点吓人的能力,稳定、便宜、可控地交到更多人手里。
周四见。
希望这一次,我们等到的不只是一条官宣,而是真的能用上。
参考资料: