#Claude
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 研究开放2026-08-27 · 周四重要度 4/5深度报告 →
Anthropic开放Claude真实使用数据研究
Anthropic 8月26日披露试点:三家外部机构通过 Anthropic Insights 分析约25万条 Claude.ai 或 Claude Code 对话;公开聚合数据,原始记录未开放。
新增点在于外部团队可在聚合工具上提出自己的研究问题。价值在于把AI影响研究从厂商自问自答推向有限独立复核。
- 产品上新2026-08-27 · 周四重要度 5/5深度报告 →
Claude in Chrome向付费计划GA
Claude 8月26日宣布 Chrome 扩展向所有付费计划GA,并允许安全分类器判定匹配请求的浏览器动作自动执行。
- 浏览器Agent从试点进入付费入口,关键新增是动作级安全分类器和管理员域名限制。
- 它也把prompt injection防线变成产品可用性的前提。
- 产品上新2026-08-26 · 周三重要度 4/5深度报告 →
Claude把记忆打通到Cowork
Claude 8月25日宣布聊天和Claude Cowork使用同一份记忆,用户可按topic查看、编辑或删除记忆。
- 这次更新把个人上下文带进云端任务执行,但也把记忆治理推到前台。
- 敏感主题默认不保存,是功能扩张同时保留用户控制的关键边界。
- 产品上新2026-08-19 · 周三重要度 3/5深度报告 →
少源|Claude Tag进入CI/CD on-call流程
少源|Claude官方博客在8月18日介绍内部CI incident response:Claude Tag以服务账号接入工具,并用GitHub skills和runbook管理指令。
- 这条是官方实践和公开kit结合的工程样本,但配套文档日期无法作为当天锚点。
- 核心看点不是成熟产品动态,而是Anthropic内部把agent放进值班流程后的身份、权限和审计边界。
- 研究论文2026-08-19 · 周三重要度 5/5深度报告 →
Claude蛋白设计命中14/15个靶点
Anthropic在8月18日发布研究页称,Claude参与de novo protein binder设计,外部实验验证14/15个靶点;单设计结合率为22%-35%。
- 这条的增量不是模型又会写科学文本,而是结果进入了湿实验验证。
- 早报关注的边界在于样本仍由Anthropic组织,且生命科学任务在更强模型中的开放访问仍受限。
- 头条2026-08-15 · 周六重要度 5/5深度报告 →
Anthropic说明Claude文本水印机制
Anthropic在8月14日说明未来Claude模型会生成带统计水印的文本。官方称不加隐藏字符,不增加token成本,也不能追踪到个人、组织或聊天。
- 这把AI内容标识从政策承诺推进到模型输出层。
- 关键边界在于检测密钥、误判率和跨厂商互认机制,普通读者肉眼识别水印并不是有效目标。
- 产品上新2026-08-13 · 周四重要度 3/5
Claude浏览器侧栏并入Cowork会话
Anthropic于8月12日将Claude in Chrome侧栏改为Cowork会话,浏览器中的对话、技能和连接器可随账户在桌面、网页与移动端续接。新侧栏当天面向Max与Team开放,Pro将在未来数周推出。
- 浏览器扩展从独立入口变成跨设备智能体会话,减少任务切换时的上下文断裂。
- 它同时扩大了已登录网页与连接器的权限面,企业默认关闭策略仍然重要。
- 行业动态2026-08-11 · 周二重要度 4/5深度报告 →
Anthropic公布Claude内容标记实施口径
Anthropic于8月10日更新帮助页:在欧盟于8月2日及以后上线的新Claude模型从发布时支持机器可读标记,文本嵌入水印,受支持文件附C2PA签名来源元数据;旧模型仍在过渡。
- 这是一份实施承诺,不等于现有所有Claude输出已可被可靠识别。
- 关键缺口是检测工具、误报率、编辑后的保留率和各云平台支持矩阵
- 研究论文2026-08-11 · 周二重要度 5/5深度报告 →
Claude研究版把黎曼ζ函数相关下界推至67.2%
Anthropic于8月10日披露,未发布Claude研究版给出一项无条件结果:黎曼ζ函数在临界线上的零点比例下界升至约67.2%。它没有证明黎曼猜想,外部同行评审仍待展开。
- 这项结果的价值在于模型产出与验证制品同步公开,而非只展示答案。
- 当前验证仍以Anthropic员工和短期专家审阅为主
- 研究论文2026-07-29 · 周三重要度 5/5深度报告 →
Anthropic:Claude 改进两类密码攻击
Anthropic 称 Claude Mythos Preview 用 60 小时显著削弱 HAWK,并把弱化版 AES 的先前最佳攻击提速 200 至 800 倍。两项结果都不影响现有生产系统。
- 高价值增量在于模型开始参与算法级密码分析,而非只找实现漏洞。
- 约 10 万美元的单项 API 成本和人工复核要求,也说明这仍是高成本研究工具。
- 模型发布2026-07-25 · 周六重要度 5/5深度报告 →
Anthropic 推出 Opus 5,维持 Opus 4.8 价格
Anthropic 7 月 24 日推出 Claude Opus 5,覆盖所有平台。基础价格为每百万输入 5 美元、输出 25 美元,与 Opus 4.8 相同。
- Opus 5 用既有 Opus 价位逼近更高档模型,把竞争推进到任务效率。
- 官方评测仍需第三方复现,尤其要把分数、每任务成本与耗时放在一起看。
- 产品上新2026-07-24 · 周五重要度 4/5深度报告 →
Claude 语音模式接入 Opus、Sonnet 与工具
Anthropic 于 7 月 23 日更新 Claude 语音模式,Opus 与 Sonnet 进入语音入口,具体可选模型仍跟随方案。付费方案可用全部已连接工具,Free 限一个。
- 语音模式从 Haiku 快问答扩展到复杂推理和获授权的工具动作。
- 能力提升仍受常规用量限制,工具调用也不是无确认自动执行。
- 产品上新2026-07-23 · 周四重要度 4/5深度报告 →
Anthropic 把 Economic Index 接入 Claude 查询
Anthropic 于 7 月 22 日在 claude.ai 上线 Economic Index 连接器,用户可查询行业、职业、地区与任务中的 Claude 使用模式,并继续查看底层数据。
- 连接器降低了数据查询门槛,却没有扩大样本代表性。
- 回答反映的是 Claude 使用模式,不能直接代表整个劳动力市场或所有 AI 产品。
- 版权治理2026-07-22 · 周三重要度 4/5深度报告 →
法官批准 Anthropic 15 亿美元图书和解
美联社在窗口内报道,法官于前一日批准 Anthropic 就使用盗版图书训练 Claude 达成的 15 亿美元集体诉讼和解。该方案早在 2025 年提出。
- 批准动作把训练数据争议从责任辩论推进到赔付执行。
- 它不会自动回答合法购买图书的训练使用是否构成合理使用,也不等于所有生成式 AI 版权案件已有统一结论。
- 科研资助2026-07-21 · 周二重要度 4/5深度报告 →
Anthropic 开放罕见病研究额度申请
Anthropic 开放 AI for Science 首个专题申请。入选项目可在六个月内获得最高 5 万美元 Claude 使用额度,申请截止于官方所写的 8 月 2 日 11:59 PM PST。
- 这是算力与模型额度资助,不是现金科研基金,也没有承诺治疗提速结果。
- 两条轨道分别押注开放知识基础设施和早期生物科技流程。
- 产品政策2026-07-19 · 周日重要度 3/5
单源跟进|Fable 5 将于7月20日调整访问
Claude 官方 X 称,7 月 20 日起 Fable 5 将纳入 Max 与 Team Premium,额度为官方所称限额的 50%。Pro 与 Team Standard 仍按用量点数访问,并将获一次性 100 美元额度。
- 这次变化是访问规则迁移,不是模型升级,也不是再提高 50%。
- 正式帮助文档尚未同步,套餐适用范围和一次性额度应继续按单源口径理解。
- 研究投入2026-07-15 · 周三重要度 4/5深度报告 →
Anthropic 承诺 1000 万加元投向加拿大 AI 研究
Anthropic 7 月 14 日宣布承诺向加拿大 AI 研究机构投入 1000 万加元,首批覆盖 8 个合作方,并发布加拿大 Claude 使用简报。
- 教育产品2026-07-15 · 周三重要度 5/5深度报告 →
Anthropic 推出 Claude for Teachers
Anthropic 7 月 14 日推出 Claude for Teachers,面向美国经认证 K-12 教师免费开放高级 Claude 能力、教师 skills 与 Learning Commons 连接器。
- 这不是泛泛教育营销,而是把教师备课、分层教学和课堂数据分析做成可复用 skills。
- 边界同样重要:它面向教师而非学生,且注册截止和访问期限都写得很具体。
- 研究发布2026-07-14 · 周二重要度 5/5深度报告 →
Anthropic 研究 Claude 价值:300K+ 对话压成四轴
Anthropic 7 月 13 日发布研究,分析 300K+ 段匿名 Claude.ai 对话,比较三种 Claude 模型与前 20 种语言中的价值表达差异。
- 这不是能力榜,而是把“模型性格”变成可量化对象。
- 四条轴只解释 15% 的变化,说明它是治理仪表盘的起点,不是完整解释器。
- 产品动态2026-07-13 · 周一重要度 3/5深度报告 →
单源|Claude X 称 Fable 5 付费访问延长至 7 月 19 日
Claude 官方 X 宣布,所有付费计划的 Fable 5 访问延长至 7 月 19 日,Claude Code 周限额继续维持在高出常规基准 50% 的水平。正式文档尚未同步具体额度。
- 限额变化会直接影响长任务能否持续运行,但单条官方 X 仍不足以说明具体计划、地区和重置规则。
- 应等待帮助文档更新。
- 产品上新2026-07-10 · 周五重要度 4/5深度报告 →
Claude Reflect beta(单源):把 AI 使用习惯变成可回看的仪表盘
Anthropic 7 月 9 日称 Claude Reflect beta 已进入 Web 和桌面端设置,可回看主题、任务类型与使用时段;产品范围目前主要由官方单源披露。
- Claude Reflect 把个人 AI 使用从聊天记录变成行为数据产品。
- 它既服务效率复盘,也提前回应过度依赖、隐私边界和健康场景的监管问题。
- 行业动态2026-07-10 · 周五重要度 4/5深度报告 →
Anthropic Hard Questions:试图把公众问题变成 AI 公司问责清单
Anthropic 启动 Hard Questions 倡议,披露 Public Record 首轮覆盖 52,000 名美国人,并用 Interviewer 调查 81,000 名 Claude 用户。
- Anthropic 把公众担忧从抽象民意转成可追踪问题清单。
- 它真正要验证的是公司能否把问责从安全论文推进到产品、政策和季度报告。
- 研究论文2026-07-07 · 周二重要度 5/5深度报告 →
Anthropic J-space 论文:在 Claude 中间层找到一个「意识工作空间」
Anthropic 发布 J-space 论文:在 Sonnet 4.5 中间层定位到占比≤10% 的「可语言化」表征,纯 J-lens 替换 88% 命中,组件替换 59%,屏蔽后多步推理几乎归零。
- 这篇论文把 Global Workspace Theory 这种神经科学级假说,变成一个可在开源权重模型上独立复现的工程对象。
- 真正决定安全含义的是 6–7% 中位方差、上限不超过 10%——Claude 真正在『思维』的部分不到十分之一。
- 产品上新2026-07-06 · 周一重要度 3/5深度报告 →
claude-real-video 让 Claude 看视频:场景感知抽帧 600 到 5-15 帧
开源 Python 工具用场景感知抽帧加音频转写,把视频压成 5-15 张关键帧加字幕文本。GitHub 24 小时内冲到 936 星、登 HN 首页 165 分 56 评论。但评论区对为什么不直接用 Gemini 吵成两派。
- 工具的真正价值不在技术而在把多模态缺口的体感变成一个 30 行的可执行命令。
- 和 Gemini 原生视频的关系不是替代而是分场景并存——crv 覆盖本地、隐私、Claude Code 生态绑定这条窄路。
- 产品上新2026-07-05 · 周日重要度 3/5
GitHub 730★:Claude 真正「看懂」视频——切帧加去重加转写
HUANGCHIHHUNGLeo、claude-real-video 仓库 730★,实现 Claude 真正观看视频:场景感知切帧、去重、转写,通过 MCP 把视频帧与转写一起喂给 Claude,实现视频问答。
- 视频是 Claude API 一直没原生支持的盲区。
- 这个工具用 MCP 加场景切帧加去重加转写的工程化拼装填补了盲区,代表 Agent 工具作者开始用 MCP 加多模态组合填补 frontier 模型的 API 缺口。
- 头条2026-07-03 · 周五重要度 5/5深度报告 →
24 小时,从"史上最强 Sonnet"到"订阅用户 7-7 起将用不到":Fable 5 重启后的三连击把 Anthropic 的最高能力民主化实验拉下了马
Claude Fable 5 在 7-1 全球恢复 24 小时后,三个独立维度同时遭遇重击:(1) @bridgemindai 在 BridgeBench 重测,Debugging 86.2 → 25.9、Refactoring 73.6 → 38.4、Hallucination 75.9 → 61.7,归因为新硬性护栏过度触发并回退 Opus 4.8;(2) @Hesamation「Fable 5 不是被 nerf,而是被屠杀」一贴 4,485 赞 / 364 转,@Khazix0918 实测 Fable 5 自主去火山引擎提交工单的 500 赞 / 11 万浏览帖,以及社区造出新词「disfabled」(disabled-by-safety)形成对照;(3) Anthropic Claude Code 团队成员 @trq212 7-2 22:49 UTC 官宣 Fable 5 将于 7-7 后从订阅下架,后续"视产能恢复回归订阅",与昨日公告中「7-7 前 Pro/Max/Team 含 50% 周配额免费额度、之后转 usage credits」路径相符;LMArena 同步数据:Fable 5 在 Code Arena:Frontend 仍居 #1 但已下滑 27 分,与 Anthropic 7-1 自承「new safeguards will flag a slightly higher fraction of harmless requests」一致。Anthropic 把「安全敏感性」抬高一档的工程取舍,正在被公开标注为「整套订阅价值被掏空」。
- 头条2026-07-02 · 周四重要度 5/5深度报告 →
21 天撤回、>99% 拦截、一份四维度框架:Anthropic Fable 5 重启给出了 AI 安全治理的新范式
Anthropic 7-1 宣布 Claude Fable 5 全球恢复(原于 6-12 因美方出口管制下架),同步联合 Amazon/Microsoft/Google 等 Project Glasswing 伙伴起草行业首个 jailbreak 严重性 4 维评估框架(能力增益/增益广度/武器化难度/可发现性),并在美国商务部 CAISI 测试下交付了拦截率 >99% 的新 safety classifier。事件回溯:6-9 发布 Fable 5 + Mythos 5,6-12 美方因 Amazon 研究者报告中可绕过 safeguard 识别软件漏洞并产出 exploit 代码而下令全部用户暂停,Anthropic 复测确认所有 8 款主流模型(含 Haiku 4.5/Sonnet 4.6/Opus 4.6/4.7/4.8/GPT-5.4/5.5/Kimi K2.7)均能产出相同利用代码、该技巧并未暴露 Mythos 级独有网络能力。Mythos 5 仅向经美方批准的美国机构开放;Fable 5 在 Pro/Max/Team 档 7-7 前含 50% 周配额免费额度、之后转 usage credits;AWS/Google Cloud/Microsoft Foundry 接入仍待恢复。
- 模型发布2026-07-01 · 周三重要度 5/5深度报告 →
Claude Sonnet 5 正式发布:agentic 能力替代更大模型,促销价 $2/$10 用 tokenizer 暗坑做『成本中性』过渡
Anthropic 在 2026-06-30 正式发布 Claude Sonnet 5,定位迄今最 agentic 的 Sonnet,在 BrowseComp(智能体搜索)与 OSWorld-Verified(计算机使用)上严格优于 Sonnet 4.6,高 effort 部分场景可匹配 Opus 4.8;促销价 $2/$10 百万 token(至 2026-08-31,之后 $3/$15),但 Sonnet 5 换了新 tokenizer,实际同输入会映射 1.0–1.35× token 数,『促销持平』其实是名义持平、真账单涨幅最高 35%。Artificial Analysis Intelligence Index 给了 53 分(与 GPT-5.5 同分、落后 Opus 4.7/4.8),首 token 时延 150 秒、总评测 $6015——典型『比 Opus 便宜近一半,智能上限低一档,latency 显著劣化』的位置。产品形态上:全线进 Free/Pro/Max/Team/Enterprise,已集成 GitHub Copilot、Notion、Cursor、Devin,速率限制简化为 Start/Build/Scale 三档。但『促销到期后涨 50% 价格+token 通胀 + effort 拉满才追上 Opus』,意味着 Anthropic 在把 Sonnet 5 当作『Opus 替代品』卖的同时,把推理成本曲线偷偷往上推了一截。
- 产品上新2026-07-01 · 周三重要度 5/5深度报告 →
Anthropic Claude Science 登场:把科学家的本地笔记本、HPC 与 GPU 云缝进同一个 AI 工作台
Anthropic 发布 Claude Science beta,把 60+ 科研连接器、NVIDIA BioNeMo 中的 Evo 2/Boltz-2/OpenFold3、多 agent 架构、本地到 HPC 与 Modal 弹性算力、可审计科研产物(3D 蛋白结构、基因组轨道、化学结构)打包成一个面向 Pro/Max/Team/Enterprise 的工作台。Manifold Bio、Allen Institute、UCSF 三组真实案例背书;同步启动 AI for Science 项目计划,最多 50 项、单项最高 $30,000 credits、Modal 额外 $2,000 算力,7 月 15 日申请截止。
- 头条2026-06-30 · 周二重要度 5/5深度报告 →
Claude Opus 4.8 / Haiku 4.5 在 Microsoft Foundry 正式 GA + Anthropic 6 月 ARR 约 470 亿美元:Azure 渠道打通与营收加速同日落地,OpenAI–Anthropic 差距进一步收窄
2026-06-29 同日落地两条关键信号。Anthropic 通过 ClaudeDevs 官方 X 宣布 Claude Opus 4.8 与 Claude Haiku 4.5 在 Microsoft Foundry(Azure 托管)正式 GA,Azure 客户可在企业租户里直接调 Claude,统一走 Azure 计费、合规与 MACC(Microsoft Azure Consumption Commitment)抵扣,且支持『Anthropic 主权基础设施』独立区域推理;同日 bboczeng 在 X 披露 Anthropic 6 月 ARR 已冲到约 470 亿美元、年底有望冲击 800 亿。Azure 渠道补齐 Anthropic 云渠道的最后一块拼图(此前 AWS Bedrock + GCP Vertex AI + 自有 API),ARR 数字则把 Anthropic 在 12 个月内从『挑战者』推到与 OpenAI 营收差距明显收窄的『第二极』位置。两条线索在 24 小时内同步出现,是 2026 H2 企业级 AI 竞争主轴的一次结构性拐点。
- 两条线索同日出现不是巧合
- Azure GA 解决的是『企业合规渠道问题』,ARR 470 亿解决的是『商业兑现问题』,二者夹击意味着 Anthropic 在 2026 H2 已经从『挑战者』正式升到『第二极』。
- 模型发布2026-06-27 · 周六深度报告 →
智谱开源 GLM-5.2(Max):753B/1M 上下文/MIT 协议,Code Arena 前端超越全部 Opus、仅次 Fable 5
智谱 AI 开源 GLM-5.2(Max),约 753B 参数、100 万 token 上下文、MIT 协议(据 HuggingFace 模型卡)。在 Code Arena 前端赛道以 1595 分排第 2、仅次 Claude Fable 5(1665 分),超越 Claude Opus 4.8 并在头对头中击败全部 Opus 变体(含 4.8/4.7 Thinking)。智谱自报 SWE-bench Pro 62.1、AIME 2026 99.2。All In 节目嘉宾 Sacks 估计中国模型落后约 9 个月、芯片落后约 24 个月,并称 GLM5 家族已用华为昇腾完成训练(此点模型卡仅确认昇腾推理,训练为单一来源待核实)。
- 研究论文2026-06-26 · 周五深度报告 →
MirrorCode 基准:Opus 4.7 仅凭运行行为重写软件,14 小时抵人类数周
Epoch AI 等机构的 MirrorCode 基准要求 AI 仅凭程序可执行行为(可运行但无源码)重写整套软件,覆盖 25 个目标程序、6 种语言(Python/C/Rust/Go/OCaml/Ada),用含隐藏测试的端到端测试判定一致性。最强模型 Claude Opus 4.7 全基准 56%(8 个月前模型约 30%);典型案例重写 1.6 万行 Go 生物信息学工具包 gotree(40+ 命令),用 14 小时通过 2000/2001 测试(99.95%)、花费 $251,人类估计需 2-17 周,单个大任务一次尝试可耗 $2600/19 天。Mollick 借此称"聊天机器人时代已结束"。
- 产品上新2026-06-25 · 周四深度报告 →
Claude Tag:AI 交互从「目的地」迁向「内嵌」
Anthropic 让 Claude 以团队成员身份加入既有协作工具。这件事的产品意义不在某个功能,而在 AI 交互范式位置的迁移——从「你要去它那」变成「它来你这儿」。
- 研究论文2026-06-24 · 周三重要度 4/5深度报告 →
EnterpriseClawBench:用真实职场会话造基准,最强 agent 也只过 0.766
一个从专有真实 agent 会话蒸馏出的企业级基准:5291 条原始任务实例经自动化流水线收敛成 852 个可复现任务。全集最强 GPT-5.5 仅 0.766,Lite 子集顶分只有 0.663,远未饱和。核心发现是 agent 表现高度依赖 harness 而非只看模型——Claude 系在 Hermes 运行时从 0.62-0.64 骤降到 0.458。
- 行业动态2026-06-22 · 周一重要度 3/5
ChatGPT 全球助手份额首次跌破 50%,Gemini/Claude 追赶
据 Sensor Tower《2026 AI 现状》报告(TechCrunch 6 月 16 日转述),到 5 月底 ChatGPT 全球 AI 助手份额首次跌破 50%、降至 46.4%(年初仍高于 50%),Gemini 升至 27.7%、Claude 10.3%。ChatGPT 月活仍超 11 亿,据称是史上最快达 10 亿用户的应用。
- 份额跌破 50% 是个心理与叙事拐点,但要分清『份额』与『绝对量』:ChatGPT 月活仍在创纪录增长,跌的是相对占比
- 意味着市场在做大、对手在更快地分蛋糕。