Claude Platform三项Agent工具GA
GA信号是agent工具链从演示走向企业工作流。
本文要点
- computer use、Skills API和Files API从beta进入Claude Platform GA。
- browser use作为computer use的新工具上线,面向Web应用操作。
- Files API获得自动过期、5x higher rate limits和每组织1TB存储。
阅读辅助
先看数字、证据和来源,再读正文。
三项核心agent工具已经在Claude Platform GA,而不是preview或仅beta。
2026-08-20 · Anthropic发布官方博客,宣布computer use、Skills API和Files API在Claude Platform GA。
Anthropic在8月20日把Claude Platform上构建生产级agent所需的三块基础设施一起推到GA:computer use、Skills API和Files API。官方博客同时说明,browser use tool是computer use今天新增的Web操作工具。这个news peg足够清楚:过去24小时新增的是正式可用状态和一个新的浏览器操作工具,而不是旧beta的一次普通文档刷新。
确定事实可以分成四层。computer use现在是Claude Platform的正式能力,更新后的工具支持每个模型调用内连续执行多个动作。browser use今天作为computer use的新工具加入,面向Web应用里的字段、按钮和页面结构。Skills API允许开发者上传并版本化自定义Skill,再把它们附加到API请求中。Files API则提供文件存储,让agent上传一次文件、后续用file_id引用,并下载由Skill或code execution生成的输出。
边界同样需要先写清。Anthropic说Skills API和Files API也可通过Microsoft Foundry使用;但updated computer use和browser use tools对Google Cloud Vertex AI的状态是coming soon,不是已经上线。官方还说existing beta integrations keep working while you migrate,这句话表达的是迁移期间继续可用,不是旧beta立即停用,也不是新接口已经覆盖所有云渠道。
对读者的直接影响在工程层。过去很多agent demo卡在三个问题:无法稳定操作旧系统,团队流程只能写在提示词里,文件输入输出需要反复上传和搬运。Claude Platform这次把这三件事做成同一条产品链路,意味着企业开发者可以从“让模型回答问题”转向“让模型按流程处理一份文件、打开一个业务系统、完成一个动作、留下可下载结果”。
状态口径先校准
这篇公告最容易被写错的是状态动词。GA、today、coming soon和keep working四个短语分别指向不同可用性,不应被压成“全面上线”。
| 原文口径 | 可写成 | 不能写成 | 核对理由 |
|---|---|---|---|
| Computer use, the Skills API, and the Files API are generally available today | computer use、Skills API和Files API今天在Claude Platform正式可用 | 三项仍处preview | generally available是GA状态,不是预览 |
| Computer use also adds a new browser use tool | browser use是computer use今天新增的工具 | Anthropic发布了一个独立浏览器模型 | 公告把它放在computer use工具体系内 |
| updated computer use and browser use tools are coming soon to Google Cloud’s Vertex AI | 新版computer use和browser use将接入Vertex AI | Vertex AI已经上线新版工具 | coming soon是未来状态 |
| Existing beta integrations keep working while you migrate | 现有beta集成在迁移期间继续工作 | beta已经立刻下线 | keep working强调兼容迁移 |
| customer case: claims workflow numbers | 客户案例显示最长流程从32分钟降到13分钟 | 所有理赔任务都会降到13分钟 | 官方没有给出通用SLA或第三方复现 |
这个表看似琐碎,但对早报很重要。Agent工具公告经常把“平台可用”“云渠道可用”“客户案例”“未来路线”放在同一段里。如果不把动词拆开,读者会得到错误采购判断:以为Vertex AI已经可用,以为所有beta都要立刻迁移,或者把一个客户workflow的效率数字当成全平台benchmark。
四个能力各自补哪块
官方博客给出的例子是一个claims agent:它从Files API读取intake document,按Skill里编码的团队申报流程执行,用browser use在保险门户里提交,再把确认文件保存回来。这个例子把四个工具的关系讲得很直白:模型不是孤立完成“问答”,而是围绕文件、流程和界面形成一个执行闭环。
| 能力 | 官方状态 | 解决的问题 | 关键限制或边界 |
|---|---|---|---|
| computer use | Claude Platform GA | 让Claude看截图,并用鼠标、键盘和滚动操作软件 | 需要沙盒化桌面或容器环境 |
| browser use | computer use今天新增 | 读取页面结构,按字段或按钮执行Web操作 | Vertex AI版本仍是coming soon |
| Skills API | Claude Platform GA;也可通过Microsoft Foundry使用 | 上传并版本化团队Skill,将流程知识附加到请求 | API Skill不等同于claude.ai和Claude Code自动同步 |
| Files API | Claude Platform GA;也可通过Microsoft Foundry使用 | 上传一次文件,用file_id在多次请求中复用 | workspace是文件隔离边界,多租户需单独设计 |
| code execution与web search | 公告称已GA | 与上述工具进入同一agent loop | 不等同于无约束外网执行 |
Computer use文档把核心循环称为agent loop:Claude发出tool_use,应用执行动作,再把结果作为tool_result返回给Claude。更新后的computer use支持batch actions,也就是Claude可以在一个响应里规划一小段动作,比如点击、输入、再截图。这个变化的价值不是“动作更多”本身,而是减少一次动作就要一次模型调用的往返成本。对UI密集的工作流,往返次数往往比模型推理本身更影响延迟和费用。
Browser use在这条链路里承担更窄也更关键的角色。传统computer use只看屏幕像素时,定位按钮和输入框容易受分辨率、滚动位置、弹窗和布局变化影响。官方博客说browser use会在截图之外加入page structure,让agent更可靠地定位Web元素。这并不消灭网页自动化的不确定性,但它把“像人眼一样猜坐标”的一部分问题,转成“按页面结构理解对象”的问题。
Skills API对应的是团队知识。官方文档把Skill描述为由instructions、metadata和可选资源组成的模块化能力,Claude会在相关任务出现时加载。与一次性提示词不同,Skill可以把组织里的SOP、模板、脚本和参考资料打包。公告强调API侧可以上传并版本化自定义Skill,并在请求中附加使用。对企业团队来说,这意味着“怎么填一份理赔表”“怎么生成合规报告”“怎么处理固定格式Excel”不必每次塞进prompt,而可以成为受控资产。
Files API则处理状态和制品。文档说明它是create-once, use-many-times的文件工作方式:上传文件后拿到file_id,后续请求引用这个ID即可;文件可list、retrieve和delete;输出也可以通过下载接口取回。更重要的是权限边界:同一workspace里的API key可以访问该workspace上传的文件,workspace才是隔离边界。若开发多租户应用,文档建议每个tenant使用独立workspace。这个细节决定了Files API不是简单“附件上传”,而是需要被纳入企业数据治理设计。
关键数字怎么读
公告中的数字可以分成平台配额和客户案例两类。前者更像产品能力承诺,后者更像案例证明。把两类数字混写,会误导读者。
| 数字 | 类型 | 早报解读 | 不能外推的部分 |
|---|---|---|---|
| 1TB per organization | 平台配额 | Files API已经给到组织级文件存储规模 | 不代表单workspace或单文件大小 |
| 5x higher rate limits | 平台配额 | Files API GA带来更高调用上限 | 公告未列端点和绝对请求量 |
| 32 minutes to 13 | 客户案例 | 官方博客客户引述称最长理赔流程缩短 | 不代表所有理赔流程或所有行业 |
| about 30% cost reduction | 客户案例 | 同一类测试工作流的cost per task下降 | 样本、计费口径和基线未披露 |
| 100% completion | 客户案例 | 客户引述称其测试流程完成率达到100% | 不等于生产环境永久100%成功率 |
最值得关注的是1TB和5x higher rate limits这两个产品数字。Files API的旧问题不是“能不能上传文件”,而是能否支持反复读取和长期流程。企业agent处理保险、医疗、法务、财务文档时,文件不是一次性输入,而是一个持续被引用、校验、改写和归档的状态对象。每个组织1TB存储和更高限流至少说明Anthropic希望把Files API放进高频生产调用,而不是停留在演示用附件。
客户案例数字的意义要更克制。32分钟到13分钟、cost per task约30%下降、completion hit 100%,都说明computer use更新和browser use可能对长流程有实际帮助。但公告没有披露客户名称、样本量、任务失败定义、人工复核比例、异常网页比例,也没有给出第三方复现实验。因此这组数字适合当成“潜在收益区间的线索”,不能当成企业采购时可直接写进ROI模型的稳定指标。
为什么是agent工程化节点
过去一年,agent产品的瓶颈不断从模型能力转向执行环境。模型能读懂指令后,企业真正关心的是:它能不能进入只提供GUI的旧系统,能不能按组织内部流程做事,能不能处理真实文件并留下可审计结果,能不能在安全边界内运行。Claude Platform这次公告正好覆盖这四个问题。
Computer use解决“软件没有API怎么办”。很多保险、医疗、政府、采购、ERP系统没有稳定开放API,或者API无法覆盖人工后台的全部操作。让agent用截图、鼠标和键盘操作软件,降低了接入门槛。但这条路天然有风险:界面漂移、提示注入、误点击和权限越界都比普通文本调用更难管。文档强调需要沙盒化虚拟机或容器环境,原因就在这里。让模型接触真实桌面之前,开发者必须先决定它能看到什么、点什么、失败后谁兜底。
Browser use是在Web场景上的针对性补强。现代Web应用里,一个按钮可能只在DOM结构中有清晰语义,截图上的像素位置却会随窗口大小改变。加入页面结构后,agent可以把“蓝色按钮大概在右下角”改成“目标是某个字段或按钮”。这不是传统RPA的简单替代,因为agent仍然通过语言任务规划行动;但它会让RPA式流程、浏览器自动化和模型工具调用之间的边界更模糊。
Skills API解决“组织流程如何进入模型”。企业内部最有价值的知识经常不在公开文档里,而在操作手册、模板、合规检查表和团队习惯中。把这些内容写进一次prompt会导致上下文膨胀,也难以版本管理。Skill把流程知识文件化,并允许通过API上传和版本化,意味着团队可以像管理代码或模板一样管理agent能力。真正难点会转移到Skill治理:谁可以发布,谁可以更新,旧版本怎样回滚,执行日志如何审计。
Files API解决“输入输出怎样保持状态”。没有文件层,agent每次调用都像从零开始,开发者必须反复传输同一份PDF、CSV或表格。Files API用file_id复用文件后,agent可以在多轮流程里持续引用同一对象,并把生成的图表、报告或确认文件下载回来。对长流程而言,这相当于把agent的工作从对话内容搬到平台可管理的文件对象上。它也带来新治理问题:同一workspace内key可访问所有文件,企业多租户实现不能只靠应用层约定。
平台分发比功能本身更关键
这次公告里容易被忽略的一句是Microsoft Foundry和Vertex AI的不同状态。Skills API和Files API已经available through Microsoft Foundry;updated computer use and browser use tools只是coming soon to Google Cloud’s Vertex AI。对多云企业来说,这句话决定了落地路线。若团队在Azure生态里构建Claude应用,文件和Skill能力已经可以进入Foundry通道;若团队依赖Vertex AI,至少新版computer use和browser use还要等后续接入。
这也解释了为什么Anthropic要保留beta迁移兼容。Computer use本身已经经历过一段开发者试用期,生产系统不会因为GA公告当天就全部重写。Existing beta integrations keep working while you migrate是一句工程承诺:已有集成不会因为发布日切换而中断,但开发者仍然需要对照新文档迁移。早报判断,这比“新增功能”更像一条平台成熟度信号。真正的企业客户不只问“能不能用”,还问“升级时会不会断”。
从竞争角度看,Anthropic正在把Claude Platform的差异化从模型参数转向agent运行面。OpenAI、Google和Anthropic都在争夺“模型能否调用工具”的入口,但企业采购通常不会只买一个模型端点。它会评估权限、文件、审计、流程复用、云市场可用性和既有系统接入成本。Anthropic把computer use、browser use、Skills API和Files API放到一篇公告里,说明它在卖的不是一个聊天模型,而是一套让agent进入真实办公系统的执行层。
风险与不确定性
安全风险需要前置设计。Computer use让模型看到屏幕并执行鼠标键盘动作,风险面天然比纯文本API更大。文档提到prompt injection防护和用户确认机制,但这不等于所有场景都适合无人值守。网页里的恶意指令、邮件正文中的隐藏提示、业务系统弹窗,都可能成为攻击面。对于保险和医疗这类HIPAA BAA覆盖下的工作负载,企业更需要把权限、确认点和审计日志前置设计,而不是只关注模型是否能完成演示。
流程脆弱性仍然存在。Browser use读取页面结构会比只看像素更可靠,但Web页面仍会变化。字段名、iframe、动态渲染、反机器人机制、验证码、文件下载策略都可能让流程中断。把agent接进生产系统,不应期待一次prompt长期稳定运行,而应为每一步动作设计失败恢复、人工接管和回放记录。官方的客户案例显示潜在收益,但没有给出跨网站、跨行业、跨异常场景的失败率。
组织知识的版本治理会成为新负担。Skill把团队流程打包成能力,这对复用有利,也让错误流程传播更快。如果一个Skill里的报销政策、理赔规则或合规模板过期,agent会稳定地执行旧知识。版本化是基础,但企业还需要审批、灰度、回滚和责任归属。尤其当Skill可以包含脚本和模板时,安全审查不只是看说明文字,还要看文件包里是否存在不符合目的的网络调用或文件访问。
这条路线对Anthropic有利,因为Claude过去在长上下文、工具使用和代码工作流中积累了开发者心智。现在它把这些优势改写成平台部件:computer use处理旧系统入口,browser use降低Web操作不确定性,Skills API沉淀组织方法,Files API保留输入输出。模型能力仍然重要,但采购讨论会越来越多地落在“这套agent系统能不能被审计、迁移、限权和复现”上。
需要保留的反面判断是,GA不等于复杂业务已经自动化完成。客户案例里的32分钟到13分钟和100%完成率,是官方博客中的客户引述,不是独立benchmark。真正决定企业是否大规模采用的,仍是异常处理、人类确认、权限隔离和跨云可用性。尤其Vertex AI目前还是coming soon,不能把这次公告写成所有主流云渠道同步上线。
接下来看什么
云分发会决定采购路径。若updated computer use和browser use tools很快进入Google Cloud,Anthropic的企业分发会更完整;若延后,则多云客户需要在Claude Platform原生通道、Microsoft Foundry和Google Cloud之间做能力取舍。
Files API的真实吞吐和治理配置会影响落地深度。1TB组织级存储和5x higher rate limits让它看起来可以承载更高频的生产任务,但文档里的workspace隔离边界意味着多租户应用必须重新设计权限模型。后续如果Anthropic公开更细的审计、生命周期和配额说明,Files API会从“上传文件”变成企业agent状态层的核心部件。
Skills API需要经受团队治理检验。上传和版本化Skill只是第一步,企业还会要求审批流、变更记录、回滚、依赖扫描和跨环境发布。官方文档已经把Skill定义成instructions、metadata和可选资源的组合,这种文件包形态很适合工程团队管理,也很容易把风险藏进脚本和模板里。
客户案例需要变成可复现实例。理赔流程从32分钟到13分钟、cost per task下降约30%、completion hit 100%,是很强的销售叙事;但如果没有公开任务定义、失败样本和人工介入口径,它仍然只是一个方向性案例。对企业买方来说,这组数字最适合用来设计试点指标,而不是直接作为上线后的效果承诺。