#Claude Fable 5
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 产品上新2026-08-07 · 周五重要度 5/5深度报告 →
Anthropic重训Fable 5生物安全分类器
Anthropic于8月7日宣布重训Fable 5生物安全分类器。公司内部测试称生物相关fallback约减少85%,双重用途请求仍切换至Opus 5。
- 新增量是减少良性生物问题被误判后的模型降级,不是取消生物安全限制。
- 专业生物研究和药物开发仍未开放,产品表面的总fallback降幅也只是公司预期。
- 模型发布2026-07-04 · 周六重要度 4/5
Fable 5 重启后实测生态:APEX-SWE 65.5% → 54.8%(仍超 Opus 4.8 9.5pp)、LMArena 5 赛道一。
继 7-3 早报深挖 Fable 5 重启后,过去 24 小时新增 APEX-SWE 数据:Fable 5 从 6 月原版 65.5% Pass@1 降到 7 月重发布版 54.8%,仍高于 Opus 4.8 的 45.3%。
- 本期数据是 7-3 深挖页的增量信号:重启版在 BridgeBench
- APEX-SWE 等硬基准上确有回归,但仍领先 Opus 4.8 约 9-10 个百分点。
- 头条2026-07-04 · 周六重要度 5/5深度报告 →
Anthropic 发布 Fable 5 cyber safeguards 完整版:CJS 4 轴评分与 4 象限分类器
Anthropic 7-2 在 Fable 5 重启公告的次日发布 cyber safeguards 完整技术细节。核心是 CJS 4 轴评分、4 象限分类器与 HackerOne 越狱征集。
- 这份完整框架把 AI 安全治理从事件响应推向制度化对齐。
- 7-2 重启公告只带过 CJS 草稿,这次公开评分细则、案例、上下调规则和 HackerOne 流程,让实验室、监管和白帽有了同一套风险语言。
- 头条2026-07-03 · 周五重要度 5/5深度报告 →
Fable 5 重启后 24 小时三连击:BridgeMind 基准雪崩、社区怒骂、Anthropic 官宣 7.7 撤出订阅
Fable 5 重启不到 24 小时,Anthropic 的旗舰模型在三个独立维度同时遭遇重击:(1) @bridgemindai 在 BridgeBench 重测,Debugging 从 86.2 跌到 25.9、Refactoring 73.6→38.4、Hallucination 75.9→61.7,主因被指为新硬性护栏过度触发并回退 Opus 4.8;(2) @Hesamation「Fable 5 不是被 nerf,而是被屠杀」获 4.4k 赞,@Khazix0918 实测 Fable 5 自主去火山引擎提交工单的 488 赞贴与社区愤怒形成对照;(3) Anthropic 团队成员 @trq212 7.2 官宣 7.7 将 Fable 5 从订阅下架、后续视产能恢复回归,LMArena 数据同时显示 Code Arena:Frontend 排名仍第 1 但已下滑 27 分,与 Anthropic 6.30 公告中「被标记率上升」自承一致。
- 昨天 (2026-07-02) 早报深度页已分析过 7.1 重启与 jailbreak 框架争议,今天增量集中在「重启后实测」与「订阅形态生死」两个维度:BridgeMind 的硬数字证明昨天担心的护栏过激不是体感问题
- 是可复现的回归