OpenAI调整ChatGPT的Sol与Luna入口
Plus与Pro聊天统一到新版Sol,免费层转向Luna;开放时间与限额需分开理解。
本文要点
- Plus与Pro的Instant和深度推理由更新版Sol统一承接,并新增推理强度滑杆。
- Free与Go默认模型在公告当周转为Luna,不限量文本与Think从公告次周开始。
- 文件、图片和其他工具限额仍保留,Work与Codex所用Sol版本本次不变。
阅读辅助
先看数字、证据和来源,再读正文。
本次更新改变的是ChatGPT聊天入口与分流,不是GPT-5.6全产品线同时换版。
2026-06-26 · OpenAI启动GPT-5.6 Sol、Terra与Luna有限预览;这是模型分档前史,不是本期新闻。
这次更新值得看的地方,是 OpenAI 把 ChatGPT 的模型选择从“用户先挑型号”进一步改成“产品先分层、用户再调推理强度”。Plus 与 Pro 的日常即时回答和深度推理,从公告当日起统一由更新版 GPT-5.6 Sol承接;Free 与 Go 则进入以 GPT-5.6 Luna为默认模型的分阶段切换。
公告确认的时间顺序并不是一次性全量开放。Free 与 Go 的 Luna 默认切换发生在公告当周;不限量文本聊天和用于难题的 Think 按钮要到公告次周开始。所谓“不限量”还受防滥用规则约束,文件上传、图片及其他工具的限额仍然保留。因此,这不是免费层在公告日获得了所有能力和无限工具使用。
效果数字也必须锁定分母。OpenAI 内部评测称,在需要事实细节的金融、医疗和法律提示中,相比 GPT-5.5 Instant,至少包含一处事实错误的回答在 Luna 上约少 62%,在 Sol 上约少 68%。这不是“模型整体正确率提高 62%或68%”,也不是外部独立基准;样本规模、判错过程和置信区间都没有随公告公开。
对用户,变化体现在入口更少、控制方式更直观;对采购和开发团队,边界同样重要:更新版 Sol 此次只进入 ChatGPT 的 Chat 体验,为 Work 与 Codex提供能力的 Sol 版本本次不变。如果把两套版本混写,企业用户会误以为工作流和编码产品已经同步升级。
一张入口图:谁在何时得到什么
OpenAI 这次没有发布一张新的 API 价格表,也没有宣布 GPT-5.6 全线再次换代。它调整的是 ChatGPT 面向不同订阅层级的默认模型、推理入口和开放节奏。把状态拆开,才能看清“现在可用”“当周切换”“次周开始”和“仍有限额”之间的差别。
| 用户或产品 | 公告当日状态 | 公告当周状态 | 公告次周开始 | 明确保留的边界 |
|---|---|---|---|---|
| Plus与Pro | 更新版Sol用于日常聊天;推理强度滑杆开始提供 | 继续按账号与客户端落地 | 公告未另行承诺新阶段 | 适用范围是ChatGPT的Chat体验 |
| Free与Go | 公告给出切换计划 | Luna将成为默认模型 | 获得不限量文本聊天与Think按钮 | 受防滥用约束;文件、图片和其他工具仍有限额 |
| Work | 本次不换所用Sol版本 | 无本次更新承诺 | 无本次更新承诺 | 不得把Chat体验更新写成Work升级 |
| Codex | 本次不换所用Sol版本 | 无本次更新承诺 | 无本次更新承诺 | 不得把Chat体验更新写成Codex升级 |
产品层级和模型层级需要分开。Plus 与 Pro 的“统一”只覆盖 ChatGPT 聊天里的 Instant 与深度推理,不覆盖 OpenAI 的每一种产品、API 或企业工作区。官方专门写明 Work 与 Codex 的 Sol is not changing as part of this release,即这两个产品的版本本次保持不变。
Free 与 Go 的“默认切到 Luna”同样是状态迁移,而不是能力列表同时解锁。长文使用 will become ... this week,说明公告发布时切换仍在当周推进;对不限量文本与 Think 则使用 Starting next week。这两个未来状态相隔一个阶段。官方 X 的精简帖另用了 starting tomorrow,与长文的节奏表述不完全一致。考虑到长文给出的条件更完整,本文以长文为准,并把实际账号覆盖列为待验证项。
百分比审计:62%和68%究竟在比较什么
公告最醒目的能力主张来自事实性评测,但它测量的对象比“幻觉减少”窄得多。OpenAI 的原始口径是:在一组需要事实细节的金融、医疗和法律提示中,统计回答是否“至少含有一处事实错误”;再比较这种回答在不同模型上的出现频率。
| 模型 | OpenAI内部结果 | 共同比较基准 | 适用范围 | 尚未证明 |
|---|---|---|---|---|
| GPT-5.6 Luna | 含至少一处事实错误的回答约少62% | GPT-5.5 Instant | 内部金融、医疗、法律事实型提示 | Luna整体正确率提高62% |
| GPT-5.6 Sol | 含至少一处事实错误的回答约少68% | GPT-5.5 Instant | 同一内部评测 | Sol在所有任务上错误减少68% |
| 两者共同限制 | 尚无独立复现 | 样本与判错细节未公开 | 厂商自报结果 | Sol必然比Luna准确6个百分点 |
最后一项尤其需要说明。68%减62%等于6个百分点只是两个相对降幅的算术差,不能直接推出 Sol 的绝对错误率比 Luna 低6个百分点。假设 GPT-5.5 Instant 在某组提示上的基线错误回答率未知,就无法从相对降幅还原两款模型各自的绝对错误率;也无法判断差异是否具有统计显著性。
这组指标仍有价值。它至少说明 OpenAI 选择用“含事实错误回答的频率”来解释用户体验改进,而不只给一个综合榜单分数。对于金融、医疗和法律这类高风险信息场景,这比笼统说“更聪明”更接近用户会遇到的问题。但在外部拿到提示集、标注准则、模型设置和重复实验之前,它只能作为产品方内部观测,不能作为专业建议可靠性的保证。
公告还称 ChatGPT 每周用户达到 10亿。这个数字解释了入口调整为何重要:默认路由的变化会作用于极大的用户面。不过,它是 OpenAI 的公司自报背景口径,不是本次新增的用户,也不能证明所有10亿用户会在同一时间看到同一模型。Free、Go、Plus、Pro 的账户分布,地区差异和客户端版本均未披露。
从三档预览到聊天分流
Sol、Terra 与 Luna 早在6月有限预览中出现,7月30日又发生 Luna 与 Terra 降价及 Sol Fast 上线。Reuters 可独立确认那次商业事件的日期,但不承担核验本期 ChatGPT 入口变化的作用。
本期新增是把既有模型分档映射到大规模消费产品:Plus 与 Pro 用 Sol 统一即时与深推理,Free 与 Go 把 Luna 放到默认入口,再用 Think 提供显式的难题升级路径。模型档位由此进入 ChatGPT 的算力分配和交互设计。
Plus 与 Pro 的滑杆是这套设计的另一个关键。用户不再主要通过切换模型名来表达需求,而是告诉 ChatGPT 每次回答应投入多少推理强度。这样做可能减少“到底该选哪个模型”的认知负担,也方便 OpenAI 在一个模型家族内管理延迟和成本。公告没有说明滑杆每档对应多少推理预算,也没有说明系统会否根据任务自动调整,因此它目前是一个可见控制面,不是可审计的计算配额。
Free 与 Go 的 Think 按钮承担类似作用:普通文本聊天走 Luna 默认路径,难题由用户显式请求更多思考。它能否稳定改善答案,取决于按钮背后的推理预算、拥塞时的容量策略和防滥用判断。官方没有披露这些机制,也没有承诺工具调用随文本聊天一起不限量。把“文本不限量”简化成“ChatGPT不限量”,会遮掉最直接的产品约束。
四句英文决定四条事实边界
四句英文决定了开放时间、适用对象与比较基准,任何一项省略都会改变新闻含义。
| 原文状态 | 忠实中文 | 编辑边界 |
|---|---|---|
will become the default ... this week | 将在公告当周成为Free与Go默认模型 | 公告时仍是进行中的未来状态 |
Starting next week | 从公告次周开始 | 公告日尚未全面开放 |
Limits will still apply | 文件、图片和其他工具仍适用限额 | still表示维持既有限制 |
is not changing as part of this release | Work与Codex所用Sol版本不随本次发布改变 | 两个产品本次没有换版 |
同样,about 62% less common与68% less common ... than GPT-5.5 Instant必须把“约”“出现频率更低”和比较基准一起保留。删掉“约”会制造不必要的精确性;删掉 GPT-5.5 Instant 会让读者不知道百分比相对谁;删掉“内部评测”则会把厂商结果伪装成行业共识。
入口简化之后,控制权去了哪里
对普通用户,统一入口的好处很直观:Plus 与 Pro 不用在即时模型和深推理模型之间反复切换,Free 与 Go 也获得更清晰的默认模型与Think入口。交互从“认识模型清单”转向“选择回答需要多认真”。这会降低上手成本,尤其适合不关心模型型号、只关心答案速度和质量的人。
对 OpenAI,统一入口还意味着更强的路由控制。产品可以在不要求用户理解快照名的情况下,安排不同层级的算力、延迟和推理预算。可用性与成本管理会更灵活,但外部透明度也可能下降:如果用户只看到Sol、Luna与滑杆,未必知道每次请求实际使用了多少推理、是否触发容量降级、模型快照何时更新。
企业团队首先需要确认产品边界。Work与Codex不随本次发布变化,意味着在ChatGPT个人订阅中观察到的答案差异,不能直接推断企业工作区或编码流程已经获得同样模型。需要版本一致性、可回归测试和合规审计的团队,应等待对应产品自己的更新说明。
对安全和政策观察者,“不限量文本受防滥用约束”留下了操作层空白。无限通常意味着不再设置普通文本次数上限,但并不排除速率限制、异常行为检测、账户处置或高峰期容量管理。官方没有公布触发条件、申诉路径和恢复机制。用户能否区分正常配额、系统拥塞和滥用防护,将直接影响这项承诺的可理解性。
这是一场面向约10亿周用户的模型路由改版。OpenAI开始把“哪款模型回答”更多收回产品层:Plus与Pro得到统一的Sol聊天面,Free与Go进入Luna默认路径,用户可见的选择逐渐变成推理强度和Think按钮。
这种设计有现实合理性。多数用户并不想维护一张不断变化的模型能力表;他们希望普通问题快,难题可以投入更多计算。统一入口能减少误选,也让同一对话在即时回答和深推理之间保持较一致的行为。若事实性评测的方向能够被外部复现,入口简化与质量改善可能同时发生。
代价是可观察性变弱。模型名减少后,版本、推理预算、拥塞降级和防滥用策略更容易藏在产品背后。滑杆与Think给了用户控制感,却尚未给出可复算的资源含义。对日常消费者这未必是问题;对需要回归测试、审计和稳定输出的团队,它决定了这次更新是便利还是新的不确定性。
因此,判断这次调整是否成功,不能只看OpenAI内部的62%和68%。还要看Free与Go能否按公告次周稳定覆盖、工具限额是否清楚、Work与Codex何时另行换版,以及外部事实性评测能否复现。入口变简单只是第一步,产品是否把被隐藏的系统边界解释清楚,才决定用户能否形成可靠预期。
接下来用三类证据验收
先看开放证据。 Free与Go用户应在公告次周开始看到不限量Luna文本聊天与Think按钮;需要记录地区、客户端、账号层级及出现时间,而不是用单个截图代表全量上线。若官方调整节奏,应明确是延后、灰度还是仅修正文案。
再看限制证据。 文件、图片和其他工具的额度应分别核对,防滥用触发时也应观察用户收到的提示、等待时间和恢复路径。只有文本聊天不再计普通次数,而工具仍有限额,产品才符合公告的原始边界。
最后看质量证据。 外部复测应使用相同的GPT-5.5 Instant基准,报告绝对错误率、样本量、领域分布、判错标准与置信区间。若只重复“少62%或68%”而没有这些分母,就仍是在转述厂商结论,尚未完成验证。