#Project Glasswing
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 产品上新2026-08-22 · 周六重要度 5/5深度报告 →
Claude Mythos 5向更多防御者开放
Anthropic 8月21日宣布Claude Mythos 5可用于Claude Security扫描,并推出3500万美元开源安全额度。
- 头条2026-07-04 · 周六重要度 5/5深度报告 →
Anthropic 把 AI 越狱打分做成行业标准:CJS 评分、四象限分类器与 HackerOne 征集
Anthropic 7-2 公布 Fable 5 cyber safeguards 细节与 CJS 草案。四象限分类器上调安全边际,CJS 用四轴把越狱分成 CJS-0 到 CJS-4,并接入 HackerOne 漏洞征集。
- 这份完整框架把 AI 安全治理从事件响应推向制度化对齐。
- 7-2 重启公告只带过 CJS 草稿,这次公开评分细则、案例、上下调规则和 HackerOne 流程,让实验室、监管和白帽有了同一套风险语言。
- 头条2026-07-03 · 周五重要度 5/5深度报告 →
Palantir Karp 在 CNBC 近 20 分钟情绪爆发:「按 token 付费 = 喂对手吃你的命」——闭源大模型在国防/企业 AI 的话语权遭遇最强买方一击
Palantir CEO Alex Karp 7-1 在 CNBC 直播采访里近 20 分钟情绪失控式输出:OpenAI、Anthropic 等闭源大模型被「不负责任地过度推销」,企业按 token 付费等于把数据与核心竞争力喂给模型厂商养对手,等于把美国企业与军方的命脉外包给几家实验室。原始视频经记者 Aaron Rupar 放出后(@atrupar),@Phoenixyin13 整理中文摘要获 1.7k 赞 / 62 万阅读,是近期企业买方对闭源模型最激烈的一次公开表态。Palantir 是美国国防/政府 AI 应用的核心承包商,其客户正是当前 OpenAI 据报「5% 股权让渡」谈判的另一端,Karp 的表态与监管侧的谈判在同一天形成对位。
- 头条2026-07-03 · 周五重要度 5/5深度报告 →
5% 股权、政府董事、AI 安全让渡均待披露:OpenAI 与美国政府的『国家利益绑定』走到哪一步
The Guardian 7-2 转载 Financial Times 报道:OpenAI CEO Sam Altman 正与美国政府进行『概念性、早期阶段』的谈判,拟将 OpenAI 约 5% 股权让渡给美国政府——具体机制参照 Alaska Permanent Fund 模式的『主权基金式』载体,把 AI 红利分配给美国公众。该提案同时要求其他美国头部 AI 公司(Anthropic / Google / Meta)做出同等让渡,但 Anthropic / Google / Meta 是否同意尚不明确。Altman 已与 Trump、Commerce Secretary Howard Lutnick、Treasury Secretary Scott Bessent 及参议员 Bernie Sanders 接触,谈判尚处概念阶段,落地或需国会授权。OpenAI + Anthropic 正在筹备美国上市,两家公司估值均被投资者预期在 1 万亿美元以上。这是 Altman 推动的『AI 与国家利益绑定』叙事的最新具体化,与 2026-06-24 OpenAI-Broadcom 联合推理芯片、6-30 OpenAI GeneBench-Pro 一起构成『硬件自主 + 政府绑定 + 安全研究』三轨布局;HN 当日 124 分 / 134 评论,讨论焦点集中在估值基准、政府董事席位、AI 安全让渡的具体边界——这三个数字恰恰都是 FT 原报道未给出的。补充:5% 股权若按各家 $1T+ 估值落地,OpenAI 单家对应约 $500 亿美元;四家全跟则政府潜在持股总规模 $2,750 亿+;但让渡要落地,必须先解开 OpenAI 双层治理结构(Foundation 26% + Microsoft 27% + 员工/投资人 47%)、Anthropic 类似 PBC 调整的同步问题——这是 FT 没写的『机制层』硬约束。
- 头条2026-07-02 · 周四重要度 5/5深度报告 →
21 天撤回、>99% 拦截、一份四维度框架:Anthropic Fable 5 重启给出了 AI 安全治理的新范式
Anthropic 7-1 宣布 Claude Fable 5 全球恢复(原于 6-12 因美方出口管制下架),同步联合 Amazon/Microsoft/Google 等 Project Glasswing 伙伴起草行业首个 jailbreak 严重性 4 维评估框架(能力增益/增益广度/武器化难度/可发现性),并在美国商务部 CAISI 测试下交付了拦截率 >99% 的新 safety classifier。事件回溯:6-9 发布 Fable 5 + Mythos 5,6-12 美方因 Amazon 研究者报告中可绕过 safeguard 识别软件漏洞并产出 exploit 代码而下令全部用户暂停,Anthropic 复测确认所有 8 款主流模型(含 Haiku 4.5/Sonnet 4.6/Opus 4.6/4.7/4.8/GPT-5.4/5.5/Kimi K2.7)均能产出相同利用代码、该技巧并未暴露 Mythos 级独有网络能力。Mythos 5 仅向经美方批准的美国机构开放;Fable 5 在 Pro/Max/Team 档 7-7 前含 50% 周配额免费额度、之后转 usage credits;AWS/Google Cloud/Microsoft Foundry 接入仍待恢复。