Topic Timeline
#GPT-5.6 Sol
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 产品定价2026-08-22 · 周六重要度 2/5
单源称OpenAI临时下调Sol价格
OpenAI官方X在8月21日称GPT-5.6 Sol的API和credit pricing未来3个月下调超过20%。
- 这条只能按官方X单源处理,因为定价页更多是背景和价格表。
- 关键是时态:这是未来3个月的促销价格,不是永久降价,也不是Pro、Plus和Business订阅额度提高。
- 模型发布2026-08-07 · 周五重要度 5/5深度报告 →
OpenAI调整ChatGPT的Sol与Luna入口
OpenAI官网标注8月6日,北京时间8月7日更新ChatGPT模型入口。Plus与Pro聊天统一使用新版Sol;Free与Go的不限量文本聊天从公告次周开始。
- 这次更新改变的是ChatGPT内的模型分流与交互入口。
- 官方内部评测提供了相对GPT-5.5 Instant的错误降幅,但Work与Codex所用Sol版本明确不随本次发布变化。
- 研究论文2026-07-01 · 周三重要度 5/5深度报告 →
OpenAI 推 GeneBench-Pro:129 道合成题把研究级智能体评估从『答题』推向『研究决策』,GPT-5.6 Sol 高档仅 28.7%
OpenAI 发布研究级基准 GeneBench-Pro,把 AI 智能体在计算生物学中的评估从『答得对』推向『能否独立做出研究级判断』,覆盖统计遗传学/群体遗传学/定量遗传学/调控组学/功能基因组学/蛋白质组学/临床-PGx-诊断/癌症基因组学/微生物基因组学/法医遗传学共 10 大域、21 个子域、129 道合成题——每道题都用已知因果结构的合成数据集,可直接模拟、绕开作者偏好。所有题经外部专家审核,UCLA Alexander Strudwick Young 给出的评价是『对没有资深导师反复指导的研究生来说都很难』。GPT-5.6 Sol 在最高推理档通过率 28.7%(Pro 模式 31.5%),最低档个位数;解题数约为 GPT-5.2 的 6 倍,token 消耗只有 2/3。GPT 与开源模型(GLM 5.2 等)的科研推理差距显著大于代码差距——说明开源更偏代码。人类专家估时 20-40 小时/题、$200/h 即数千美元,而推理成本仅几美元/题。10 题已开源至 Hugging Face,50 题将给 Artificial Analysis;OpenAI 预判年底该基准会被刷满。