本文要点
- Grok 4.5 从模型发布页进入 Grok Build、Cursor 和 xAI console 的可用叙事。
- Automations 从聊天请求变成可保存、可定时、可由邮件触发的任务。
- 官方 X 同步扩散欧洲可用性和 Automations,但没有新增系统卡或独立榜单。
阅读辅助
先看数字、证据和来源,再读正文。
两篇 xAI News 页面都标注 2026-07-16 UTC,折算进北京时间 7 月 17 日窗口。
2026-07-15 · xAI 发布 Grok Build 开源公告,开放编码代理和 TUI 源码;本文仅作背景。
模型和触发器同日上线
xAI 在北京时间 7 月 17 日窗口里给 Grok 同时补上了两块拼图:一块是模型,一块是任务入口。Introducing Grok 4.5 与 Automations in Grok 两个 xAI News 页面都在结构化数据中标注 2026-07-16T00:00:00Z,折算后进入本期归档窗口。Grok 官方 X 随后把欧洲可用性和 Automations 做了二次扩散,但本期事实锚点仍以 xAI News 页面为准。
Grok 4.5 页面的核心表述是,它是 xAI 面向 coding、agentic tasks 和 knowledge work 的模型。页面称模型已经可在 Grok Build、Cursor 全计划以及 xAI console 使用,并给出每百万输入 token 2 美元、每百万输出 token 6 美元的基础 API 价格。页面还写到 80 TPS、约 2 倍 token 效率等厂商自报指标;这些可以作为官方发布口径记录,但不能改写成独立验证过的行业排名。
Automations 页面的增量更像产品形态变化。xAI 写明,用户描述一次任务,选择运行时间后,Grok 会在之后自行运行。计划触发支持一次、每日、工作日、每周、每月、每年,并按用户时区执行。邮件触发则会观察收件箱,当新邮件匹配 sender、recipient 或 subject 过滤条件时启动,并把那封邮件作为上下文传给 Grok。页面还写到每次运行会保存为一条真实对话,用户可以打开历史线程继续接话。
这两件事放在同一天,说明 xAI 正在把模型能力和可重复任务入口并排推进。Grok 4.5 负责给代理任务提供更强执行底座;Automations 负责把一次性聊天变成带触发器、运行历史和回报渠道的持续工作流。两者之间的连接仍有很多未公开边界,尤其是邮件权限、连接器权限、失败回滚和审计日志。
事实口径核对
这组发布里最需要克制的是时态和适用范围。Grok 4.5 页面里,模型能力和价格都是 xAI 自己发布的状态描述;Automations 页面里,触发器和回报方式是明确功能说明;Grok 官方 X 是扩散信号,不应替代页面正文。下表只保留可追溯到官方页面或官方 X 的说法。
| 事项 | 官方页面可确认 | 本文采用的写法 | 不能外推成 |
|---|---|---|---|
| 发布时间 | 两个 News 页面均标注 2026-07-16 UTC | 折算进北京时间 7 月 17 日窗口 | 不是 7 月 17 日 UTC 发布 |
| Grok 4.5 定位 | coding、agentic tasks、knowledge work | 面向代码、智能体任务和知识工作的模型 | 有公开系统卡或独立总榜 |
| Grok 4.5 可用入口 | Grok Build、Cursor 全计划、xAI console | 已进入主要开发者入口 | 所有地区、所有配额都无限制 |
| 基础价格 | 每百万输入 2 美元、输出 6 美元 | 官方 API 价格口径 | 成功任务总成本固定更低 |
| Automations 触发 | 日程或邮件触发 | 定时任务和邮件触发任务 | 任意事件源或任意系统权限 |
| 邮件触发过滤 | sender、recipient、subject | 邮件过滤条件有限且明确 | 可读取任意邮箱上下文 |
| 回报方式 | email、app notification、both、neither | 用户可选择通知方式 | 默认具备企业审计或告警闭环 |
Grok 4.5 页面对训练也给了一些细节。它称模型训练数据覆盖 coding、science、engineering 和 math,强化学习覆盖数十万项任务,重点是多步骤软件工程和其他技术工作,评分方式包括自动化评分和模型评分。这里的关键是“官方称”和“覆盖方向”;当前没有独立实验支撑。没有模型卡、系统卡、任务集列表和第三方可复现实验时,不能把这些描述写成已经被外界验证的能力边界。
Automations 页面则比模型页更接近产品说明。它列出创建方式、触发器、运行记录和回报方式,并明确 scheduled automations available to everyone,email triggers included with SuperGrok。中文表述需要保留这个适用范围:计划任务面向所有人,邮件触发包含在 SuperGrok 中。不能把它写成“所有用户都能用邮件触发”,也不能把“邮件触发”扩写为可读取完整邮箱历史。
为什么同日发布值得看
过去一年,AI 助手的竞争正在从单次问答转向任务持续性。单次回答的性能差异仍然重要,但用户真正会感知到的是:模型能否在固定时间做完一件事,能否在新邮件到来时自动整理,能否把运行结果变成可追溯线程,能否在失败时让人知道发生了什么。Automations 正好把这些问题从抽象代理能力拉回具体产品界面。
Grok 4.5 的角色是底座。xAI 页面把它放进 Grok Build 和 Cursor,说明它首先要服务工程和知识工作,而不是只在聊天窗口里给出更流畅的回答。页面声称 80 TPS 和约 2 倍 token 效率,也说明 xAI 在发布叙事里把速度和成本放到了可执行任务旁边。对代理任务来说,这一点很实际:一次任务往往不是一个请求,而是一串规划、工具调用、阅读、修改、检查和回报。
Automations 承担调度层角色。用户不用每次打开聊天窗口重新写提示,而是保存指令、选择触发器、等待运行结果。页面描述的运行历史也很关键:每一次自动化运行都保存成完整对话,用户可以阅读线程,或者从 Grok 停下的地方继续。这让自动化保留了与聊天产品相连的可解释路径,而不仅是后台脚本。
不过,任务入口一旦连接邮箱和工具,风险也随之上升。页面说可以在指令里用 @ 提及 connector,让 Grok 在每次运行中使用它;这对效率有帮助,也意味着权限模型必须足够清楚。企业用户真正会问的是:连接器读取了哪些数据,邮件触发拿到哪些字段,失败后是否会重试,重试是否会重复发邮件,运行历史是否能导出,管理员是否能审计。Automations 页面没有把这些问题全部回答完。
背景:Grok Build 开源不是当天新增
Grok Build 开源页标注的是 2026-07-15 UTC,因此不能当作 7 月 17 日的新鲜主事实。它仍然值得作为背景,因为页面说明了 xAI 正在把 coding agent、TUI、agent loop、tools、skills、plugins、hooks、MCP servers 和 subagents 这一套开发者栈公开出来。也就是说,Grok 正在把模型、开发者工具和任务自动化放到同一条工作流上。
这个背景有助于理解 Automations。Grok Build 处理的是“让代理完成构建任务”;Automations 处理的是“让任务在指定条件下反复运行”;Grok 4.5 处理的是“让底层模型更适合代码、智能体任务和知识工作”。三者组合后,xAI 的产品方向更像一个工作执行层,而不是单纯的模型发布节奏。
但背景不能替代新事实。Railway 插件、Kilo Code 用户偏好、Grok Build 开源都可以解释生态走向,却不能用来证明 Grok 4.5 在本期已经有公开系统卡,也不能证明 Automations 已经具备完整企业级权限审计。深度页需要把这些线索放在次级位置,避免把“生态活跃”写成“能力已被验证”。
早报判断是,xAI 这次值得关注的重心在模型发布与 Automations 同时出现。Grok 4.5 提供执行底座,Automations 把一次性聊天推进到可重复运行的任务入口。模型厂商正在把“回答得更好”改造成“按条件持续做事”,用户的比较维度也会转向任务完成率、权限边界、运行记录和失败恢复。
对开发者,Grok 4.5 的价格、速度和 Cursor、Grok Build 入口值得测试,测试目标应放在整项任务成功成本和失败处理。对企业,Automations 的邮件触发和连接器能力还需要更强透明度。只要任务会读邮件、调用工具或回报结果,就必须能解释谁授权、读了什么、做了什么、失败时如何停下。
因此,这条新闻的正确位置是“产品工作流升级”。xAI 已经给出了足够清楚的发布锚点和功能入口,但还没有给出足够完整的系统卡、独立评测和权限审计材料。接下来要看自动化任务在真实工作里是否稳定、可控、可追责。
权限和可靠性是后续重点
Grok 4.5 是否会补公开系统卡或模型卡,是模型侧重点。页面已经给了训练方向、价格和入口,但安全边界、拒答策略、工具调用限制、评测任务集和失败类型仍缺少统一说明。若 xAI 想让企业把 Grok 放进持续任务链,这些材料会比单项 benchmark 更重要。
Automations 的权限与审计是否会透明化,是产品侧重点。计划任务本身风险较低,邮件触发和 connector 使用才是关键。后续需要观察它是否支持管理员策略、运行日志导出、敏感连接器限制、失败回滚、人工确认门槛以及重复触发保护。没有这些机制,自动化越方便,越容易把错误放大。
Grok Build、Cursor 和 Automations 是否会共享任务状态,是生态侧重点。若三者只是并列入口,用户得到的是更多按钮;若它们能共享项目上下文、运行记录、权限配置和失败恢复,Grok 才更接近一个连续工作代理。7 月 17 日的增量已经把方向摆出来,下一步要看 xAI 能否把方向变成可验证的工程质量。