2026年7月2日 · 周四

从「前沿模型之争」切换到「治理与工作流自动化」:Anthropic Fable 5 全球回归 + 行业首个 jailbreak 4 维框架,Claude Code background agents 端到端开 PR

  • 过去 24 小时,AI 圈的叙事主线从「谁发了更强的模型」切换到「谁把 agent 工作流的最后一公里做掉了」。
  • Anthropic 7-1 宣布 Fable 5 全球恢复访问,联合 Amazon/Microsoft/Google 等 Project Glasswing 伙伴起草 jailbreak 严重性评估与响应共识框架(4 维度:能力增益/增益广度/武器化难度/可发现性),配套新 safety classifier(拦截率 >99%)、HackerOne 漏洞悬赏、24/7 监控与更深的美政府合作
本期判断
  • 今天 AI 圈的故事主线从「谁发了更强的模型」切换到「谁把 agent 工作流的最后一公里做掉了」。
  • Anthropic 用 Fable 5 回归 + jailbreak 4 维框架 + HackerOne + 24/7 监控四件套,把 AI 治理从单家防御推向行业协作标准
  • 这是 6-12 出口管制事件后第一次系统性的 industry-wide 治理响应

本期速览

3 条
  1. 01Anthropic 7-1 宣布 Fable 5 全球恢复访问
    • Mythos 5 已于 6-26 恢复给部分美国组织
  2. 02Anthropic 联合 Amazon/Microsoft/Google 等 Glasswing 伙伴起草 jailbreak 严重性共识框架(4 维度:能力增益/增益广度/武器化难度/可发现性),同步推 HackerOne 漏洞悬赏与 24/7 监控
    • Anthropic 联合 Amazon
  3. 03Claude Code 2.1.198 发布 32 项 CLI 变更
    • Claude in Chrome 正式 GA、background agents 在 worktree 完成后自动 commit

过去 24 小时,AI 圈的叙事主线从「谁发了更强的模型」切换到「谁把 agent 工作流的最后一公里做掉了」。这一天没有新发布的旗舰模型刷新榜单,但出现了 4 个标志性的范式转移信号——Anthropic 用 Fable 5 回归 + jailbreak 4 维框架 + HackerOne + 24/7 监控,把 AI 治理从单家防御推向行业协作标准,这是 6-12 出口管制事件后第一次 system-wide 的 industry-wide 治理响应,Anthropic 同时主动披露『所有测试模型包括 Haiku 4.5 都能产出同样的利用代码』,等于公开承认前沿 vs 中端模型的安全护城河不存在——这是 Anthropic 第一次主动拆解自己的护城河叙事。

Claude Code 2.1.198 把 background agents 推到 PR 自动开立——这是 agent 工具从「副驾驶」到「独立交付」的临界点,开发者从此可以真的「下班后让 agent 干活」;Cognition Devin Security Swarm 用 Agentic MapReduce 把 AI 安全扫描从「单 agent token 成本问题」转成「并行扫描的工程问题」;智谱 ZCode 把 GLM-5.2 包装成 IDE + 1.5x 订阅 + BYOK 三件套,是开源中国模型厂商第一次向开发者订阅生态迁移;Nous Hermes Agent v0.18.0「The Judgement Release」 完善 agent 工作流可观测性,/usage 命令在任意调用点查看用量明细。

四条暗线在 7-02 同日加速:AI 治理(从单家到行业) / agent 工作流(从对话到交付) / AI 安全扫描(从单 agent 到 MapReduce) / 订阅生态(从 API 到 IDE)。模型层的同质化竞争已让位,工作流 / 治理 / 订阅三条战线同日开打。

On this page

本期导航

Deep Dives

本期重点 · 深度报告

5 篇

Key Numbers

新 safety classifier 拦截率

  • Anthropic 官方,对 Amazon 研究者 bypass 路径拦截率 >99%
  • CAISI 测试认可新 safeguard 极强
  • 代价是常规编码/调试任务回退 Opus 4.8
来源:Anthropic 官方博客 →
>99%

ZCode HN 热度

  • HN 266 分(12 评论)+ 81 分(169 评论)
  • HN 双帖均围绕 GLM-5.2 harness 与 Claude Code 类比
来源:HackerNews →
266 分 / 81 分双帖

GLM Coding Plan 订阅者额度加成

  • ZCode 内 GLM 编程计划订阅者使用额度直接翻 1.5 倍
  • BYOK 机制支持配置现有 API key 或关联第三方订阅
来源:ZCode 官网 + Zai_org X →
1.5x
Briefs

快讯 · 已核验与追踪

8 条
产品上新重要度 4/5中置信官方源

Cognition Devin Security Swarm:Agentic MapReduce 架构把 AI 安全扫描做成并行任务,成本更低、准确度更高

  • Cognition 发布 Devin Security Swarm
  • 在复杂代码库中查找安全漏洞的更便宜、更准确的新方案,基于全新架构 Agentic MapReduce。
  • Map 阶段:并行派出多个 Devin 子 agent 同时扫描不同模块/文件树
  • Reduce 阶段:汇总各子 agent 的发现,交叉验证、消除重复、聚类可疑路径。
要点拆解展开
Why

Agentic MapReduce 是 AI 安全扫描的成本/准确度问题被并行化解决的新架构,是继 Devin Fusion 之后 Cognition 把多 agent 范式推到垂直场景的标志性产品。

Impact
  • AI 安全厂商:Snyk / Veracode / Checkmarx 等传统 SAST 需要回应『AI agent 并行扫描』的成本曲线冲击
  • 企业买方:大代码库的安全扫描从「按代码量计费」转向「按并行 agent 数计费」
  • Cognition:Devin 系列产品向垂直 marketplace 延伸(安全/数据/SRE)的产品节奏
Numbers
Devin Security Swarm 架构
Agentic MapReduceCognition 全新架构;Map 阶段并行扫描、Reduce 阶段汇总验证;对比单 agent 顺序扫描Cognition X
早报判断
  • Devin Security Swarm 真正的价值不在「又一款 AI 安全工具」,而在 Agentic MapReduce 把 AI 安全扫描从「单 agent token 成本问题」转成「并行扫描的工程问题」
  • 这是 OpenAI Deep Research、Devin Fusion、AgentKit 等『harness 化』范式在垂直场景的又一次落地。
  • 多 agent 并行扫描与 Reduce 汇总的思路与 Google MapReduce 同构,但 Agentic MapReduce 处理的对象是『漏洞假设』而非『数据分片』,这是 AI 原生范式对经典分布式计算的重新定义。
  • Cognition 把 Devin 往「AI 做安全」垂直延伸,意味着 agent 厂商正在从『通用软件工程』走向『垂直 agent marketplace』(安全/数据/SRE/财务),与 Anthropic Claude Science 的『科研垂直』对位。
接下来看
  • Devin Security Swarm 在 OWASP Top 10 / CVE 实测数据集上的基准复现数据(独立第三方)
  • 单 Devin agent 与 Swarm 的 token 成本对比与扫描时间对比
观点观察重要度 3/5中置信已核验

Sonnet 5 / Claude 生态 7-02 增量:LMArena 首测视频 + Fable 5 配额配比策略(7-01 已 deep,本期增量)

  • 7-02 关于 Sonnet 5 / Claude 生态的增量信息:
  • (1) LMArena 与 Peter Gostev 合作发布 Sonnet 5 在 Agent Arena 上的首测上手视频(YouTube),具体评分稍后公布,补齐 Sonnet 5 的第三方独立测评
  • (2) surim0n(@surim0n)系统分享 Fable 5 配额稀缺下的实战配比策略
  • 只投在不可逆决策(数据模型/API 契约/核心抽象)、用 GPT-5.5 做上下文压缩、Fable 写架构/PRD、Codex 实现、Fable 产出『治理廉价舰队』的工件(评测套件、rubric、system prompt),一次 frontier 会话塑造数千次下游调用,均摊近零
要点拆解展开
Why
  • Sonnet 5 / Claude 生态 7-02 增量信息(LMArena 首测视频 + Fable 5 配额配比策略)对 7-01 已 deep 过的 Sonnet 5 报告是有效补齐
  • surim0n 的『配额治理』策略揭示 multi-tier model workflow 的实战范式。
Impact
  • 企业买方:Fable 5 配额稀缺下的实战配比(不可逆决策用 Fable / 上下文压缩用 GPT-5.5 / 实现用 Codex)成为 multi-tier 部署的标配
  • OpenRouter / Fireworks:模型分层(frontier / mid / open)的计费模型需要回应多 tier 部署需求
  • Anthropic:Sonnet 5 + Fable 5 + Opus 4.8 三档定价需要观察企业实际使用比例。
Numbers
Fable 5 7-7 前周限额免费额度
50%Pro/Max/Team/select Enterprise 用户 7-7 前可使用 Fable 5 周限额的 50% 免费额度dotey X + Anthropic 官方
早报判断
  • surim0n 给出的『Fable 5 配额配比策略』揭示了一个被忽视的事实:Fable 5 的 50% 周限额(7-7 前)在实战中必须做严格的『配额治理』
  • 把 Fable 投在不可逆决策、用 GPT-5.5 做上下文蒸馏、Fable 产出可复用的评测套件/rubric/system prompt 一次 frontier 会话塑造数千次下游调用。
  • 这与 Claude Science 的『reviewer agent 自校』思路同构
  • 前沿模型的真正价值不是『多写几段代码』,而是『产出一份可以被中端模型复用的工件』,这是 multi-tier model workflow 的真正落地。
接下来看
  • Peter Gostev 在 LMArena 首测视频中给出的 Sonnet 5 具体评分与排名
  • surim0n 的『Fable 5 配额治理』策略是否被其他 KOL 跟进(形成 community playbook)
#Sonnet 5#Fable 5#LMArena#multi-tier model
研究论文重要度 3/5中置信已核验

Orca 开源 computer use:HF 论文 176 分,基本复刻 Codex app 全部功能,只剩 record & replay 未开源

  • HF 论文《Orca: The World is in Your Mind》(arXiv 2606.30534,HF 176 分,本日 HF 候选最高)开源了 computer use 能力,基本复刻 Codex app 全部功能。
  • @LinearUncle 实测:Orca 开源的 computer use 跟 Codex app 一样好用,到目前为止 Codex app 的功能几乎都能在开源里找到替代
  • 唯一还没看到对手的只剩 record & replay(录制回放)。
  • 这意味着开发者不再需要 Codex 订阅即可获得『computer use』能力,OpenAI 在 computer use 上的产品护城河进一步收窄。
要点拆解展开
Why
  • Orca 是 HF 当日分数最高的开源 computer use 论文,基本复刻 Codex app 全部功能,意味着 OpenAI 在 computer use 上的产品护城河收窄
  • record & replay 是 OpenAI 仅剩的产品差异。
Impact
  • OpenAI:Codex app 的 computer use 产品护城河被开源阵营收窄,需回应『record & replay』的差异化
  • 开源 agent 生态:Orca + OpenCUA + OSWorld 形成开源 computer use 标准
  • 企业买方:computer use 能力部署成本下降,无需 Codex 订阅
Numbers
Orca HF 分数
176 分本日 HF 候选最高;arXiv 2606.30534HuggingFace Papers
Codex app 复刻完整度
几乎全部(仅 record & replay 未开源)@LinearUncle 实测:Orca 开源 computer use 跟 Codex app 一样好用LinearUncle X
早报判断
  • Orca 开源 computer use 真正改变的是『computer use』从 OpenAI 产品护城河转向社区基础设施
  • 这是继 OSWorld / OpenCUA 之后第三个重要的开源 computer use 框架。
  • HF 176 分(本日候选最高)反映社区对『脱离 OpenAI 订阅的 computer use 能力』的强需求。
  • 唯一还剩 record & replay(录制回放)未开源,意味着 OpenAI 在『工作流录制 + 回放』上的产品差异还在,但这个差距可能在 1-2 个月内被追上。
接下来看
  • Orca 在 SWE-bench / OSWorld / WebArena 等第三方基准的具体表现
  • 开源 community 何时补齐 record & replay 能力(预计 1-2 个月)
#Orca#Computer Use#Codex app#开源
行业动态重要度 3/5中置信已核验

OKX AI Agent Marketplace 实测:Codex 跑通 onchainos + okx-a2a 注册 ASP,链上 A2A 雇佣 + 收款成真

  • OKX 推出 AI Agent Marketplace,基于 A2A(Agent to Agent)协议实现 agent 发现工作、互相雇佣、完成任务、链上收款。
  • @blmario669 实测:把 OKX 介绍推文丢给 Codex,Codex 一路跑通了安装 onchainos / okx-a2a、登录钱包、注册 ASP(Agent Service Provider)、提交审核(中间授权两次)。
  • 底层是 A2A,人只需授权
  • 市场任务很多,等审核通过让 agent 自动找任务、沟通、接单、交付。
要点拆解展开
Why

OKX AI Agent Marketplace 是 A2A 协议成为链上 agent 经济标准的标志性产品,@blmario669 实测显示 Codex 已可跑通完整注册流程。

Impact
  • crypto / DeFi:A2A 协议成为链上 agent 经济标准,新的 marketplace 形态可能挑战传统 freelancer marketplace
  • OpenAI Codex:被验证可用于链上 agent 注册流程,Codex 在 crypto 场景的可用性提升
  • AI agent 经济:从『meme 概念』走向『可工作的产品』,ASP 注册 + 任务赏金 + 链上收款的闭环验证。
Numbers
Codex 跑通注册步骤
安装 onchainos / okx-a2a、登录钱包、注册 ASP、提交审核@blmario669 实测;中间需授权两次;A2A(Agent to Agent)协议作为底层blmario X + OKX X
早报判断
  • OKX AI Agent Marketplace 真正改变的不是『agent 接单』,而是 A2A(Agent to Agent)协议成为链上 agent 经济的标准
  • agent 之间可以互相雇佣、链上结算,人类只需授权。
  • 结合 theeleven(11 个 AI 智能体开足球盘)和 OKX Marketplace,2026 H2 正在形成『链上 agent 经济』的完整雏形:agent 是经济主体,人是授权方,A2A 是协议层,链上是结算层。
  • 这是 crypto + AI agent 范式从『meme 概念』走向『可工作的产品』的关键节点。
接下来看
  • ASP 审核通过的实际通过率与 agent 自动接单的成功率
  • OKX AI Agent Marketplace 实际任务成交额与赏金规模
#OKX#AI Agent Marketplace#A2A#链上 agent
产品上新重要度 2/5高置信官方源

Firecrawl /monitor 升级到 web-scale:从单页/单站监控跃升为全网监测,新内容上线即向 agent 发通知

  • Firecrawl 发布 web-scale 版 /monitor:常驻搜索,监测整个网络,新内容一上线即向你或你的 agent 发通知。
  • 此前 /monitor 只能监控单页或单个网站,现可作用于全网。
  • 当日上线。
  • 这意味着 agent 可以订阅『全网新内容』而不再是『单站新内容』,agent 的信息获取半径从 RSS / 站点级跃升到 web-scale。
要点拆解展开
Why

Firecrawl /monitor web-scale 是 agent 感知层基础设施的标志性升级,把 agent 的信息获取半径从『单站 RSS』跃升到『全网监测』。

Impact
  • agent 开发者:web-scale 监测能力补齐 agent 的感知层,可订阅全网新内容并触发工作流
  • RSS / 站点监测工具:差异化能力收窄,需向『感知 + 推理』融合转型
  • 企业:web-scale 监测的成本与合规边界(全网爬取的合法性)需要评估。
Numbers
/monitor 监测范围
从单页/单站升级到全网此前 /monitor 只能监控单页或单个网站,现可作用于全网;新内容一上线即向 agent 发通知Firecrawl X
早报判断
  • Firecrawl /monitor 升级到 web-scale 真正改变的是 agent 的『信息获取半径』
  • 从 RSS / 站点级订阅跃升到全网监测。
  • 这意味着 agent 的『感知层』基础设施正式形成,搭配 Firecrawl 已有的爬取能力,Firecrawl 正在成为『agent 时代的搜索引擎』。
  • 结合 Orca 开源 computer use
接下来看
  • web-scale /monitor 的实际成本与全网爬取的合规边界
  • Firecrawl 后续是否推出『按主题订阅』『按行业订阅』等细分能力
#Firecrawl#/monitor#agent 基础设施#web-scale
产品上新重要度 2/5高置信官方源

Fish Audio S2.1 Pro 对开发者免费开放:83 语种、无用量硬上限,接口与付费版一致

  • Fish Audio 宣布 S2.1 Pro(付费版同款 TTS)对开发者免费开放,提供免费 API,支持 83 种语言,无硬性用量上限,沿用同一接口。
  • 已集成的只需把 model 设为 "s2.1-pro-free" 即可切换到 S2.1 Pro。
  • 这是 Fish Audio 把付费版核心模型开放给开发者的产品策略——降低 TTS 集成门槛、抢占开发者心智。
要点拆解展开
Why
  • Fish Audio 把付费版 S2.1 Pro 完全免费开放(83 语种 + 无用量上限),是 TTS 市场『基础能力免费化』的标志性产品策略
  • Fish Audio 抢占开发者心智的对标对象是 ElevenLabs。
Impact
  • ElevenLabs / OpenAI TTS:S2.1 Pro 免费后市场份额压力增加,需回应差异化能力(情感 / 实时流 / 长上下文)
  • TTS 市场:基础能力免费化趋势明显,差异化必须走向情感 / 多语种 / 实时流等垂直场景
  • 语音 AI 应用:Fish Audio 接口兼容性(模型名 s2.1-pro-free)降低集成成本。
Numbers
S2.1 Pro 支持语种数
83 种语言免费 API,无硬性用量上限,沿用同一接口;已集成者只需把 model 设为 s2.1-pro-freeFishAudio X
早报判断
  • Fish Audio 把 S2.1 Pro 开放免费,本质上是『TTS 市场的 ElevenLabs 替代叙事』进入新阶段
  • 83 语种 + 无用量硬上限 + 沿用付费版接口,等于把 ElevenLabs 付费版的核心能力完全免费化。
  • 这与智谱 ZCode 的 GLM Coding Plan 1.5x
  • Nous Hermes Agent 网页抓取 60x 形成呼应:2026 H2 正在出现一波『基础能力免费化』的产品策略,目的都是抢占开发者心智而非直接 API 收入。
接下来看
  • Fish Audio 免费 TTS 的长期成本承担能力
  • S2.1 Pro 实际质量与付费版一致性(独立基准对比)
#Fish Audio#S2.1 Pro#TTS#ElevenLabs 替代
产品上新重要度 2/5中置信已核验

Codex App / CLI / SDK 可搭配任意开源模型使用:Codex 切换为 GLM 已成可用模式

  • @thsottiaux 提醒:Codex App、CLI、SDK 可搭配任意开源模型使用,不限于 OpenAI 模型
  • @zarazhangrui 进一步指出可以把 Codex 的模型切换为 GLM。
  • 这意味着 Codex 不再是 OpenAI 模型的专属载体,开发者可以用 Codex 的产品形态跑任意开源模型
  • BYOK 范式在 OpenAI 自身产品上的落地。
要点拆解展开
Why

Codex 支持任意开源模型(包括 GLM)是 OpenAI 自家产品做 BYOK 兼容的标志性事件,反映『模型可替换性』成为 2026 H2 开发者基本要求。

Impact
  • OpenAI:Codex 不再绑定 GPT-5 系列,把护城河定义为『agent 产品形态 + 多模型兼容』
  • GLM / Qwen / DeepSeek / Llama:接入 Codex 的开发者群体扩大,边际用户增加
  • ZCode / Cursor / Claude Code:BYOK 兼容成为标配,产品差异化能力收窄。
Numbers
Codex 支持的模型范围
任意开源模型 + OpenAI 模型Codex App、CLI、SDK 均可搭配任意开源模型使用;@zarazhangrui 实测可切换为 GLMthsottiaux X + zarazhangrui X
早报判断
  • Codex 支持任意开源模型,这意味着 OpenAI 自家产品 Codex 也在做『BYOK 兼容』
  • 开发者可以保留 Codex 的产品体验,同时把模型切换为 GLM / Qwen / DeepSeek / Llama 等开源选择。
  • 这与智谱 ZCode 的 BYOK 形成对位:两家产品都把 BYOK 作为关键差异化卖点,反映 2026 H2 『模型可替换性』成为开发者基本要求。
  • Codex 作为 OpenAI 旗下产品支持 GLM 是一个微妙的产品策略:OpenAI 把 Codex 的护城河定义为『agent 产品形态 + 多模型兼容』,而非『绑定 GPT-5 系列』,这是产品边界的重要调整。
接下来看
  • Codex 多模型兼容的官方文档完善度与最佳实践指南
  • 开发者社区对 Codex + GLM 组合的实际采用率与场景
行业动态重要度 2/5中置信已核验

Kulaxyz/self-learning-skills GitHub Trending 739★:AI 编码 agent 的自学习 skill 框架

  • GitHub 上 Kulaxyz/self-learning-skills 项目本日达 739★(discovery 候选最高),定位『A self-improving skill for AI coding agents』,兼容 Claude Code、Cursor、AGENTS.md 等主流 agent harness。
  • 这是继 7-01 awesome-evals(606★)
  • theeleven(691★)之后的第三个 600+ stars 的 agent 基础设施项目,反映『agent 自学习 / 自我改进』成为社区新热点。
要点拆解展开
Why

self-learning-skills 739★ 是本日 discovery 候选最高分,反映『agent 自学习』从研究走向社区产品,兼容 Claude Code / Cursor / AGENTS.md 三大 harness。

Impact
  • agent harness 厂商:Claude Code / Cursor / AGENTS.md 需要回应『自学习 skill』的能力扩展
  • agent 框架开发者:self-learning 作为新范式,与 harness 化范式互补
  • GitHub Trending:agent 基础设施项目持续走高(7-01 awesome-evals 606★
Numbers
self-learning-skills GitHub stars
739★本日 discovery 候选最高分;兼容 Claude Code / Cursor / AGENTS.mdGitHub
早报判断
  • self-learning-skills 739★ 真正反映的是『agent 自学习』从研究概念走向社区产品
  • Claude Code / Cursor / AGENTS.md 三大主流 harness 同时兼容,意味着开发者不再需要为每个 agent 写死 skill,而是用一个自我改进的 skill 框架。
  • 这是与 Devin Fusion / Claude Science 的『harness 化』范式互补的另一条路径:harness 解决『agent 怎么调用』,self-learning-skill 解决『agent 怎么学习新能力』。
  • 739★ 反映社区对『agent 不再被 skill 列表锁死』的强需求。
接下来看
  • self-learning-skills 的实际自学习机制(offline 微调 / 在线 prompt 优化 / context 累积?)
  • Claude Code / Cursor / AGENTS.md 官方对 self-learning skill 的支持节奏
Developing

发展中 · 待进一步核验

1 条

以下内容仅作为追踪线索,不与已核验新闻等量呈现;正式文件、项目材料或独立复核出现后再升级。

行业动态重要度 1/5中置信发展中

待验证|Claude App 新增 Google 账号登录:无手机号验证,直接登录成功

  • @xiongchun007 实测:用 Google 账号直接登录了 Claude App,无手机号验证,直接登录成功。
  • 之前 App 登录界面似乎没有 Google 登录选项。
  • 这是 Anthropic 在降低用户进入门槛的产品改进
  • 尤其对中国开发者更友好(Google 账号相对 Anthropic 直接注册需要海外手机号更易获取)。
要点拆解展开
Why

Claude App 新增 Google 账号登录是 Anthropic 在降低用户进入门槛上的产品改进,对中国开发者尤其友好。

Impact
  • 中国开发者:Claude App 进入门槛降低,Claude Code / Fable 5 / Claude Science 的中国用户基础扩大
  • Anthropic:全球用户基础扩大,尤其 Google 账号覆盖的发展中国家
  • 合规:Google 账号与 Anthropic 账号的数据共享边界需要观察。
Numbers
登录验证方式
Google 账号,无手机号验证实测可直接登录成功;此前 App 登录界面似乎没有 Google 登录选项xiongchun007 X
早报判断
  • Claude App 新增 Google 账号登录的产品改进反映 Anthropic 在『降低用户进入门槛』上的实际推进
  • 尤其对中国开发者(此前需要海外手机号注册 Anthropic 账号),Google 账号的普及度与可用性显著更高。
  • 配合 Fable 5 7-1 全球回归 + jailbreak 框架,Anthropic 在 7-02 形成『治理 + 可用性』的双线推进。
  • 但需观察:Google 账号登录是否会带来新的合规边界(Google 账号与 Anthropic 账号的数据共享),以及中国地区 Google 账号的可用性。
接下来看
  • Google 账号登录的官方公告与正式上线时间
  • Google 账号与 Anthropic 账号的数据共享边界
#Claude App#Google 登录#用户体验#中国市场
Social Radar

社交雷达 · X 讨论

6 条
ClaudeCodeLog@@ClaudeCodeLog292 likes
  • Claude Code 2.1.198 发布,共 32 项 CLI 变更。
  • 亮点:Claude in Chrome 正式 GA(general availability),无需安装即可在浏览器里直接访问会话与 agents
  • Background agents 在 worktree 中完成代码后自动 commit、push 并开 draft PR,端到端交付自动化
  • 文档建议用 grep 做搜索,并明确了 head_limit / unlimited / offset 语义以减少踩坑。
原帖 ↗
dotey@@dotey54 likes
  • Fable 5 于 7 月 1 日起恢复上线。
  • Pro、Max、Team 和部分 Enterprise 用户在 7 月 7 日之前,每周使用量限额的 50% 可用于 Fable 5
  • 7 月 7 日之后改为按 usage credits 计费
  • 标准 Enterprise 席位无免费额度,全部积分计费。
AnthropicAI
  • Anthropic 官方:Claude Fable 5 将于明日全球恢复上线。
  • 在与美国政府一系列建设性对话后,重新部署时附带一套新分类器以定向拦截更多网络安全任务
  • 短期内部分常规任务(编码、调试)将回退到 Opus 4.8,接下来数周会持续调优分类器以降低误报并更好地区分真正滥用与合法请求。
原帖 ↗
arena@@arena120 likes
  • Fable 5 已重新进入 Arena。
  • 首次发布时 Fable 5 在 Agent Arena(衡量真实世界、长周期 agentic 表现的基准)排名 #1
  • 该榜单基于全球用户提交的数百万真实任务,模型可访问网页搜索
  • 文件系统与终端工具以完成复杂工作流,采用因果追踪衡量每个模型相对平均模型的优势,而非简单胜率。
claudeai

Fable 5 is back.

原帖 ↗
oragnes@@oragnes3 likes
  • 智谱官方正式发布 GLM-5.2 专属开发环境 ZCode。
  • GLM 编程计划订阅者在 ZCode 中使用额度直接翻 1.5 倍,支持 macOS / Windows / Linux 全平台下载。
  • ZCode 引入 BYOK(Bring Your Own Key)机制,允许直接配置现有 API key 或关联第三方订阅方案。
Zai_org
  • Introducing ZCode, the official development environment for GLM-5.2
  • GLM Coding Plan 订阅者额度 1.5x,支持 BYOK(可绑定现有订阅和 API),macOS、Windows、Linux 均可下载。
原帖 ↗
zarazhangrui@@zarazhangrui60 likes

提醒:可以把 Codex 的模型切换为 GLM。

thsottiaux

Reminder: Codex App、CLI、SDK 可搭配任意开源模型使用,不限于 OpenAI 模型。

原帖 ↗
cognition@@cognition464 likes
  • Cognition 发布 Devin Security Swarm:在复杂代码库中查找安全漏洞的更便宜
  • 更准确的新方案,基于全新架构 Agentic MapReduce。
原帖 ↗
更多讨论7 条
FishAudio@@FishAudio570 likes
  • Fish Audio 最好的语音模型对开发者免费开放。
  • S2.1 Pro(付费版同款 TTS)提供免费 API,支持 83 种语言,无硬性用量上限,沿用同一接口。
  • 已集成的只需把 model 设为 "s2.1-pro-free" 即可切换到 S2.1 Pro。
原帖 ↗
firecrawl@@firecrawl289 likes
  • Firecrawl 发布 web-scale 版 /monitor:常驻搜索,监测整个网络,新内容一上线即向你或你的 agent 发通知。
  • 此前 /monitor 只能监控单页或单个网站,现可作用于全网。
  • 当日上线。
原帖 ↗
xiongchun007@@xiongchun00719 likes
  • 用 Google 账号直接登录了 Claude App,无手机号验证,直接登录成功。
  • 之前 App 登录界面似乎没有 Google 登录选项。
原帖 ↗
LinearUncle@@LinearUncle68 likes
  • 开源 Orca 的 computer use 跟 Codex app 一样好用。
  • 到目前为止 Codex app 的功能几乎都能在开源里找到替代——唯一还没看到对手的只剩 record & replay(录制回放)。
原帖 ↗
blmario669@@blmario669170 likes
  • 手把手测试 OKX AI Agent 市场:把 OKX 介绍推文丢给 Codex,Codex 一路跑通了安装 onchainos / okx-a2a、登录钱包、注册 ASP、提交审核(中间授权两次)。
  • 底层是 A2A(Agent to Agent),人只需授权
  • 市场任务很多,等审核通过让 agent 自动找任务、沟通、接单、交付,看能不能真赚到任务赏金。
okx
  • AI agent 已能工作、创造、赚钱,现在有 marketplace。
  • Introducing OKX AI:agent 发现工作、互相雇佣、完成任务、链上收款。
原帖 ↗
surim0n@@surim0n498 likes
  • 如何最大化 Fable 5 用量:
  • (1)只投在不可逆决策——数据模型、API 契约、核心抽象,周结束就难以回退
  • (2)把 GPT-5.5 放在前面做上下文压缩,先读全仓再把蒸馏数据交给 Fable,input token 很珍贵
AnthropicAI
  • Anthropic:Fable 5 将于明日全球恢复上线,新版分类器拦截更多网络安全任务,部分编码/调试回退 Opus 4.8
  • 已与 Amazon、Microsoft、Google 等 Glasswing 伙伴起草 jailbreak 严重程度评估框架。
原帖 ↗
ClaudeDevs@@ClaudeDevs0 likes

Anthropic 官方:与美国政府协商后已更新网络安全 safeguards,绝大多数编码工作……(推文截断,详见被转推原文)。

claudeai

Following conversations with the US government, we've updated our cybersecurity safeguards. The vast majority of coding work…

原帖 ↗