产品上新

xAI 同日发布 Grok 4.5 与 Automations

Grok 4.5 强化代码与智能体任务,Automations 把助手推向定时和邮件触发工作流。

2026年7月17日 · 周五深度报告高置信重要度 4/5

本文要点

  • Grok 4.5 从模型发布页进入 Grok Build、Cursor 和 xAI console 的可用叙事。
  • Automations 从聊天请求变成可保存、可定时、可由邮件触发的任务。
  • 官方 X 同步扩散欧洲可用性和 Automations,但没有新增系统卡或独立榜单。

阅读辅助

先看数字、证据和来源,再读正文。

2 项同日官方更新
3 类任务模型定位范围
5 条 Claim Audit

两篇 xAI News 页面都标注 2026-07-16 UTC,折算进北京时间 7 月 17 日窗口。

5 个时间点

2026-07-15 · xAI 发布 Grok Build 开源公告,开放编码代理和 TUI 源码;本文仅作背景。

5 个来源3 个非 X 来源

模型和触发器同日上线

xAI 在北京时间 7 月 17 日窗口里给 Grok 同时补上了两块拼图:一块是模型,一块是任务入口。Introducing Grok 4.5Automations in Grok 两个 xAI News 页面都在结构化数据中标注 2026-07-16T00:00:00Z,折算后进入本期归档窗口。Grok 官方 X 随后把欧洲可用性和 Automations 做了二次扩散,但本期事实锚点仍以 xAI News 页面为准。

Grok 4.5 页面的核心表述是,它是 xAI 面向 coding、agentic tasks 和 knowledge work 的模型。页面称模型已经可在 Grok Build、Cursor 全计划以及 xAI console 使用,并给出每百万输入 token 2 美元、每百万输出 token 6 美元的基础 API 价格。页面还写到 80 TPS、约 2 倍 token 效率等厂商自报指标;这些可以作为官方发布口径记录,但不能改写成独立验证过的行业排名。

Automations 页面的增量更像产品形态变化。xAI 写明,用户描述一次任务,选择运行时间后,Grok 会在之后自行运行。计划触发支持一次、每日、工作日、每周、每月、每年,并按用户时区执行。邮件触发则会观察收件箱,当新邮件匹配 sender、recipient 或 subject 过滤条件时启动,并把那封邮件作为上下文传给 Grok。页面还写到每次运行会保存为一条真实对话,用户可以打开历史线程继续接话。

这两件事放在同一天,说明 xAI 正在把模型能力和可重复任务入口并排推进。Grok 4.5 负责给代理任务提供更强执行底座;Automations 负责把一次性聊天变成带触发器、运行历史和回报渠道的持续工作流。两者之间的连接仍有很多未公开边界,尤其是邮件权限、连接器权限、失败回滚和审计日志。

事实口径核对

这组发布里最需要克制的是时态和适用范围。Grok 4.5 页面里,模型能力和价格都是 xAI 自己发布的状态描述;Automations 页面里,触发器和回报方式是明确功能说明;Grok 官方 X 是扩散信号,不应替代页面正文。下表只保留可追溯到官方页面或官方 X 的说法。

事项官方页面可确认本文采用的写法不能外推成
发布时间两个 News 页面均标注 2026-07-16 UTC折算进北京时间 7 月 17 日窗口不是 7 月 17 日 UTC 发布
Grok 4.5 定位coding、agentic tasks、knowledge work面向代码、智能体任务和知识工作的模型有公开系统卡或独立总榜
Grok 4.5 可用入口Grok Build、Cursor 全计划、xAI console已进入主要开发者入口所有地区、所有配额都无限制
基础价格每百万输入 2 美元、输出 6 美元官方 API 价格口径成功任务总成本固定更低
Automations 触发日程或邮件触发定时任务和邮件触发任务任意事件源或任意系统权限
邮件触发过滤sender、recipient、subject邮件过滤条件有限且明确可读取任意邮箱上下文
回报方式email、app notification、both、neither用户可选择通知方式默认具备企业审计或告警闭环

Grok 4.5 页面对训练也给了一些细节。它称模型训练数据覆盖 coding、science、engineering 和 math,强化学习覆盖数十万项任务,重点是多步骤软件工程和其他技术工作,评分方式包括自动化评分和模型评分。这里的关键是“官方称”和“覆盖方向”;当前没有独立实验支撑。没有模型卡、系统卡、任务集列表和第三方可复现实验时,不能把这些描述写成已经被外界验证的能力边界。

Automations 页面则比模型页更接近产品说明。它列出创建方式、触发器、运行记录和回报方式,并明确 scheduled automations available to everyone,email triggers included with SuperGrok。中文表述需要保留这个适用范围:计划任务面向所有人,邮件触发包含在 SuperGrok 中。不能把它写成“所有用户都能用邮件触发”,也不能把“邮件触发”扩写为可读取完整邮箱历史。

为什么同日发布值得看

过去一年,AI 助手的竞争正在从单次问答转向任务持续性。单次回答的性能差异仍然重要,但用户真正会感知到的是:模型能否在固定时间做完一件事,能否在新邮件到来时自动整理,能否把运行结果变成可追溯线程,能否在失败时让人知道发生了什么。Automations 正好把这些问题从抽象代理能力拉回具体产品界面。

Grok 4.5 的角色是底座。xAI 页面把它放进 Grok Build 和 Cursor,说明它首先要服务工程和知识工作,而不是只在聊天窗口里给出更流畅的回答。页面声称 80 TPS 和约 2 倍 token 效率,也说明 xAI 在发布叙事里把速度和成本放到了可执行任务旁边。对代理任务来说,这一点很实际:一次任务往往不是一个请求,而是一串规划、工具调用、阅读、修改、检查和回报。

Automations 承担调度层角色。用户不用每次打开聊天窗口重新写提示,而是保存指令、选择触发器、等待运行结果。页面描述的运行历史也很关键:每一次自动化运行都保存成完整对话,用户可以阅读线程,或者从 Grok 停下的地方继续。这让自动化保留了与聊天产品相连的可解释路径,而不仅是后台脚本。

不过,任务入口一旦连接邮箱和工具,风险也随之上升。页面说可以在指令里用 @ 提及 connector,让 Grok 在每次运行中使用它;这对效率有帮助,也意味着权限模型必须足够清楚。企业用户真正会问的是:连接器读取了哪些数据,邮件触发拿到哪些字段,失败后是否会重试,重试是否会重复发邮件,运行历史是否能导出,管理员是否能审计。Automations 页面没有把这些问题全部回答完。

背景:Grok Build 开源不是当天新增

Grok Build 开源页标注的是 2026-07-15 UTC,因此不能当作 7 月 17 日的新鲜主事实。它仍然值得作为背景,因为页面说明了 xAI 正在把 coding agent、TUI、agent loop、tools、skills、plugins、hooks、MCP servers 和 subagents 这一套开发者栈公开出来。也就是说,Grok 正在把模型、开发者工具和任务自动化放到同一条工作流上。

这个背景有助于理解 Automations。Grok Build 处理的是“让代理完成构建任务”;Automations 处理的是“让任务在指定条件下反复运行”;Grok 4.5 处理的是“让底层模型更适合代码、智能体任务和知识工作”。三者组合后,xAI 的产品方向更像一个工作执行层,而不是单纯的模型发布节奏。

但背景不能替代新事实。Railway 插件、Kilo Code 用户偏好、Grok Build 开源都可以解释生态走向,却不能用来证明 Grok 4.5 在本期已经有公开系统卡,也不能证明 Automations 已经具备完整企业级权限审计。深度页需要把这些线索放在次级位置,避免把“生态活跃”写成“能力已被验证”。

早报观点

早报判断是,xAI 这次值得关注的重心在模型发布与 Automations 同时出现。Grok 4.5 提供执行底座,Automations 把一次性聊天推进到可重复运行的任务入口。模型厂商正在把“回答得更好”改造成“按条件持续做事”,用户的比较维度也会转向任务完成率、权限边界、运行记录和失败恢复。

对开发者,Grok 4.5 的价格、速度和 Cursor、Grok Build 入口值得测试,测试目标应放在整项任务成功成本和失败处理。对企业,Automations 的邮件触发和连接器能力还需要更强透明度。只要任务会读邮件、调用工具或回报结果,就必须能解释谁授权、读了什么、做了什么、失败时如何停下。

因此,这条新闻的正确位置是“产品工作流升级”。xAI 已经给出了足够清楚的发布锚点和功能入口,但还没有给出足够完整的系统卡、独立评测和权限审计材料。接下来要看自动化任务在真实工作里是否稳定、可控、可追责。

权限和可靠性是后续重点

Grok 4.5 是否会补公开系统卡或模型卡,是模型侧重点。页面已经给了训练方向、价格和入口,但安全边界、拒答策略、工具调用限制、评测任务集和失败类型仍缺少统一说明。若 xAI 想让企业把 Grok 放进持续任务链,这些材料会比单项 benchmark 更重要。

Automations 的权限与审计是否会透明化,是产品侧重点。计划任务本身风险较低,邮件触发和 connector 使用才是关键。后续需要观察它是否支持管理员策略、运行日志导出、敏感连接器限制、失败回滚、人工确认门槛以及重复触发保护。没有这些机制,自动化越方便,越容易把错误放大。

Grok Build、Cursor 和 Automations 是否会共享任务状态,是生态侧重点。若三者只是并列入口,用户得到的是更多按钮;若它们能共享项目上下文、运行记录、权限配置和失败恢复,Grok 才更接近一个连续工作代理。7 月 17 日的增量已经把方向摆出来,下一步要看 xAI 能否把方向变成可验证的工程质量。