GPT-5.6 全员免费:Luna 成为新默认,Sol 合并模式并迎来推理滑块
发布日期:2026-08-07 | 数据来源:OpenAI 官方公告
2026 年 8 月 7 日,OpenAI 宣布对 ChatGPT 全系产品进行重要调整:免费版和 Go 档用户的默认模型升级为 GPT-5.6 Luna,并获得无限量文本聊天权限;GPT-5.6 Sol 同步推出 Instant 与 Thinking 模式合并、五档思考滑块下放和更简洁的回答风格三项改进,其在金融、医疗、法律等高敏感领域的错误率相比 GPT-5.5 降低 68%;三档模型的最大价格差距在 7 月 30 日一轮降价后已从 5 倍扩大至 25 倍(Sol $5/$30 不变,Luna 降至 $0.20/$1.20),Luna 的成本大幅降低但其擅长场景定位不变;下一代超大规模模型 Astra 据悉已进入 RC 阶段,预计近期发布,定位于长时程、多智能体协作任务。

Luna 免费开放:对免费用户意味着什么
GPT-5.6 Luna 是 GPT-5.6 家族中定位"快速与廉价"的一档,主要擅长摘要、分类、字段抽取等不需要复杂推理的结构化任务。
这次开放的核心内容:
替代 GPT-5.5,成为 Free 和 Go 档的默认模型
文本对话无限量,不再有每日次数限制
免费版新增 "Think" 按钮,可以主动触发更高强度的推理,不需要切换模型
几条需要注意的边界:
文件上传、图片生成、语音对话仍有额度限制,只有文本聊天去掉了上限
Luna 本身的能力天花板不变——7 月 30 日 OpenAI 的降价公告里已经说清楚,Luna 变便宜了,但"品质依旧不足"的任务品质不会因为降价而改变
对大多数日常场景(写邮件、快速问答、整理笔记、代码补全),Luna 足够用。对需要多步推理、长文档分析或复杂代码生成的场景,Plus 及以上用户仍需要切换到 Terra 或 Sol。
Sol 的三项改进:模式统一 + 滑块下放 + 回答更简洁
GPT-5.6 Sol 这次没有发布新版本,而是在现有基础上做了三项交互层面的改进:
① Instant 与 Thinking 模式合并
过去,Sol 有两个入口:Instant(直接出答案,速度快)和 Thinking(深度推理,等待时间更长)。两种模式在界面上是分开的,用户需要在提问前明确选择。
合并之后,Sol 统一成一个入口,内部根据任务复杂度自动调配推理资源,不再需要用户手动判断该用哪种模式。
② 五档推理滑块下放
原本只对 ChatGPT Work 企业订阅开放的五档推理滑块(控制思考时间/深度),今天同步开放给 Plus 和 Pro 用户。五个档位从"快速响应"到"深度思考",用户可以根据任务性质手动调节,相当于在一个模型里获得了粗粒度到细粒度的推理成本控制。
③ 回答风格变化
Sol 的输出策略做了调整:更多直接给出结论和关键判断,减少把所有相关信息罗列在一起的"信息堆叠"模式。这个改变主要影响的是追求简洁输出的场景——不需要看完一大段铺垫才到结论。

错误率数据:Sol 在高敏感领域的表现
这次公告附带了一组错误率对比数据,覆盖金融、医疗、法律三个领域:
GPT-5.6 Sol 相比 GPT-5.5 Instant,错误率降低 68%
GPT-5.6 Luna 相比 GPT-5.5 Instant,错误率降低 62%
这组数据有两点值得注意:
一是对比基准是 GPT-5.5 Instant,不是 GPT-5.5 Thinking。GPT-5.5 Thinking 本身已经在事实准确率上优于 Instant,所以这个 68% 的降幅背后,部分来自 Sol 天然更偏"深度推理"的定位,而不仅仅是模型迭代的进步。
二是三个领域都是高敏感场景,这类场景对事实准确性要求极高,错误的代价也最大。这个数据更多说明 Sol 在需要精确引用、事实核查的场景下已经可用,而不是描述它在日常对话中的改进幅度。
三档模型定价与选用逻辑
GPT-5.6 三档模型的分工在 7 月 30 日一轮降价后变得更清晰:
降价前,Luna 输入 $1.00,Sol/Luna 价差约 5 倍;降价后,Luna 降至 $0.20,价差扩大到 25 倍。
三档选用的基本判断:
Luna 适合高频、低复杂度的批量任务——对话分类、字段抽取、摘要生成,关键指标是成本
Terra 适合中等复杂度的内容生产——长文撰写、文档分析、普通代码任务,兼顾质量与成本
Sol 适合需要连续推理的高价值任务——多文档交叉分析、复杂代码重构、需要事实核查的高敏感场景
OpenAI 同时为 Sol 推出了 Fast mode(2.5 倍速度,2 倍价格),面向需要旗舰智能但对响应速度要求更高的场景。
免费版新增的"Think"按钮
这次改动里有一个容易被忽略的细节:免费用户拿到了 "Think" 按钮。
这意味着免费版用户不再只能使用 Luna 的标准推理,在需要的时候可以主动触发更深度的思考——虽然深度上限仍低于付费版的完整滑块,但这是 ChatGPT 第一次让免费用户可以主动干预推理深度。
这个设计改变了"免费版 = 固定体验"的认知。以前,免费用户要用更强的推理必须升级套餐;现在,偶发性的复杂查询可以在免费档内用 Think 按钮临时提升,不再必须订阅。
下一步:Astra
与这次升级同期流传的信息是,OpenAI 的下一代模型 Astra 已进入 RC(Release Candidate)阶段。
从流出信息来看,Astra 的定位与 Sol 有明显差异:
规模:参数量传闻达 7-10T,自 GPT-4.5 以来最大的预训练模型
能力定位:长时程、多智能体协作,可连续运行数小时至数天的复杂任务
对标目标:据内部说法,目标是超越 Anthropic Fable 5
如果这些信息属实,Astra 的发布会把 ChatGPT 的能力上限再推一层——当前 Sol 的五档滑块和合并模式,更多是把已有能力的交互方式做整齐;而 Astra 代表的是下一个能力跃迁。
怎么用好这次升级
免费用户:默认模型已升级,日常文本对话无需任何操作,遇到复杂问题主动点"Think"按钮。图片生成和文件上传的额度没变,原来怎么用现在还是怎么用。
Plus 用户:可以用五档推理滑块按任务性质调节,常规内容生产放在 Terra,复杂推理切到 Sol,批量处理成本敏感任务用 Luna。Sol 的 Fast mode 对需要快速周转旗舰质量结果的场景是新选项。
开发者(API 侧):Luna 降价 80% 对高频调用的成本影响显著。7 月 30 日的降价已经生效,低复杂度任务的批量处理成本已经下来了。通过 API 统一接入三档模型并按场景路由,是控制总体推理成本的常见方案。七牛云 AI Token Plan 支持多款主流大模型并发调用,对需要在同一工作流里混用不同推理档次的团队,可以通过单一 Token 积分池管理 Luna/Terra 等不同强度的调用成本。
延伸阅读
OpenAI 官方公告:https://openai.com/index/improving-gpt-5-6-sol-in-chatgpt/
七牛云 AI Token Plan:https://www.qiniu.com/ai/plan