产品上新

8月8日跟进|xAI介绍Image 2.0消费端状态

消费端Quality Mode已正式可用;API仍是coming soon,资格与地区范围未披露。

2026年8月9日 · 周日深度报告中置信重要度 4/5

本文要点

  • 官方传播从8月7日产品页延伸到8月8日Grok账号介绍。
  • Quality Mode在网页、iOS和Android的正式可用范围得到明确。
  • API仍停留在coming soon,开发者交付层没有完成。

阅读辅助

先看数字、证据和来源,再读正文。

3类正式可用消费端入口
最多5张多参考图输入上限
5 条 Claim Audit

8月8日新增是官方账号介绍,承载正式可用状态的发布页日期为8月7日。

4 个时间点

2026-08-07 · xAI发布页承载Image 2.0的正式可用状态,页面与JSON-LD均标注8月7日。

6 个来源4 个非 X 来源

产品状态矩阵:先分清可用层级

这条更新适合先看状态,而不是先看效果形容词。xAI在8月7日发布的产品页承载正式可用信息;Grok官方账号在北京时间8月8日11:30发出“Announcing Imagine Image 2.0”,把页面带进本期窗口。后一个动作是官方介绍和传播,不是模型在次日再次上线。

官方原句为:“Imagine Image 2.0 is now generally available as the new Quality Mode on grok.com/imagine, and our iOS and Android apps.”这里的now generally available只覆盖句中明确列出的网页、iOS与Android三个消费端入口。页面紧接着写:“API access is coming soon.”动词仍是未来时,意味着开发者接口尚未被这份公告宣布为可用。

对象截至本期的状态原文或证据报道边界
xAI产品页8月7日承载正式可用状态now generally available页面日期不能当作精确上线时刻
Grok网页端Quality Mode正式可用grok.com/imagine被明确列出未披露免费或付费资格
Grok移动端iOS与Android正式可用两个平台被逐项列出未披露国家、地区和额度
Grok on X状态未说明公告没有列入入口范围沉默既不证明可用,也不证明不可用
Image 2.0 API尚未开放API access is coming soon没有日期、模型ID、价格与调用文档
Arena评测两个指定赛道暂列第二low配置进入文生图与单图编辑榜单动态偏好榜单不是全能力验收

因此,面向普通用户可以写“消费端Quality Mode已正式可用”,面向开发者只能写“API即将推出”。公告也没有说明所有用户免费可用、全球无地区限制,或已经在X内的Grok入口全量开放。把“generally available”扩大成这些结论,会越过原文的对象范围。

日期、动词与来源各证明一件事

这次材料有一个容易被搜索结果掩盖的时间差。xAI News索引和产品页都把条目标为8月7日,而Grok官方帖的可核时间是北京时间8月8日11:30。前者回答“承载产品状态的页面是哪一天”,后者回答“本期窗口新增了哪一次官方传播”。产品页的JSON-LD把发布日期规范化为零点,但零点只适合确认日历日期,不能当作服务在该时刻切换的运维记录。

两处官方材料承担的证据职能也不同。产品页能证明三个消费端入口、功能清单、最多5张参考图以及API的未来时状态;Grok帖子能证明8月8日发生了正式介绍,并能证明厂商用了“precision editing”“crisp text rendering”和“improved factuality”等措辞。帖子没有写API,不能用它覆盖页面里的coming soon;页面没有给订阅矩阵,也不能从“正式可用”推导每个账户都已获得权限。

Arena是独立于厂商的榜单来源,但它只承担排名证据。它能证明抓取时某个明确配置在两个明确赛道中的相对位置,不能替xAI证明所有细分能力。The Decoder则是窗口内媒体交叉来源,确认公开报道确实围绕榜单和编辑工具展开;它没有发布自己的复现实验,因此不能把媒体转述再包装成第二套性能验证。

FAQ处在更外围。它能说明Grok Imagine环境中的水印和持续审核规则,帮助读者判断产物能否直接进入商业流程,却不能证明Image 2.0的上线日期、访问资格或新模型效果。把每个来源限制在它能证明的范围内,结论就会保持稳定:8月7日页面记录消费端正式可用,8月8日官方账号进行介绍,API仍待未来公告。

Quality Mode装入了哪些创作动作

xAI把Image 2.0描述成面向“real creative work”的生成与编辑模型,产品页重点不只是一轮文生图,还包括选区编辑、组合素材和版式处理。Magic Wand用于指向局部,segmentation负责更精细地选择区域;背景移除可导出透明背景素材;智能扩图允许选定宽高比后补全画面。

多参考图编辑一次最多接受5张输入图。这一上限把人物、商品、风格和场景参考放进同一次生成,但官方没有公布不同订阅层级是否共享同样额度,也没有给出输入分辨率、输出分辨率、失败率或排队时延。页面同时介绍模板化工作流,却未逐项给出独立上线时间和资格条件。

能力官方说明能够支持的结论仍缺的生产证据
Magic Wand与分割可以选择局部区域并定向修改非目标区域的保持率、边缘误改率
背景移除可以导出透明背景主体发丝、半透明物体与复杂边缘质量
多参考图单次最多输入5张参考图身份一致性、冲突素材处理和额度
智能扩图可按目标比例补全画面构图连续性、长边分辨率和稳定性
文字与版式xAI称小字更清晰、复杂版式更稳多语言拼写、长文本和品牌规范测试

Grok官方帖还使用了“crisp text rendering”“improved factuality”和“real world usefulness”。这些是厂商对模型效果的主张,可以忠实转述,却不能在没有细分测试时改写成已被独立证实。尤其是图像“事实准确性”涉及物体关系、世界知识、文字内容和场景约束,单个总体偏好分数无法覆盖全部维度。

消费端还有两条通用边界。xAI FAQ说明生成图片与视频包含Grok水印,且没有移除设置;开启NSFW也不会关闭内容审核,部分内容始终禁止。这些规则能帮助理解Grok Imagine的产品环境,但FAQ没有补充Image 2.0的订阅层级、地区、专属额度或API日期,不能拿通用说明填补本次发布的空白。

两个第二名如何解读

Arena官方榜单在本期抓取时显示,grok-imagine-image-2.0 (low)在Text-to-Image Overall以1320 ±12暂列第2名;第一名gpt-image-2 (medium)1380 ±5。在Single Image Edit赛道,前者以1439 ±8暂列第2名,后者为1463 ±4

这里有三层限定。其一,low是Arena显示的模型配置标签,不是“低质量模型”或本文的低置信度。其二,榜单衡量的是特定赛道内的人类相对偏好,分数与名次会随着新增投票和参评模型变化。其三,两项第二名可以说明Image 2.0在总体生成偏好和单图编辑偏好上处于前列,却不能单独证明文字准确率、事实性、多轮一致性或局部编辑保持率。

The Decoder在8月8日的跟进报道也把重点放在“位于GPT-Image-2之后”和新增编辑工具上。这提供了独立媒体对榜单位置与产品功能的交叉核对,但报道本身仍主要引用xAI与Arena,没有增加一套可复现的文字、事实准确性或企业生产稳定性测试。

消费端交付之后,开发者还在门外

Image 2.0当前完成的是消费端产品交付:用户能在网页与双移动端选择新的Quality Mode,使用选区、多参考图、扩图与模板完成操作。它还没有完成开发者交付,因为公开材料没有Image 2.0的API模型ID、输入输出格式、计费单位、并发限制、错误码和正式开放日。

这个差别决定了能力能否进入稳定工作流。消费端适合人工试做海报、商品图和社交素材;API开放后,团队才可能把素材库检索、批量变体、审核、版本管理与重试接成自动管线。即使API上线,生产判断还需要成功率、单图成本、尾部时延、可复现性和内容治理记录,不能由消费端体验或Arena排名代替。

北京时间8月9日00:27,Elon Musk账号继续传播局部选择与即时编辑演示。这是窗口内的产品展示信号,可以帮助确认xAI正强调“可编辑”而非只强调“能生成”;它不改变发布页的入口范围,也不把coming soon推进成API已开放。

早报观点

Image 2.0最值得关注的变化,是xAI把图像产品的叙事从一次生成推进到消费端编辑工作流。选区、多参考图、透明背景与扩图都指向同一目标:减少生成结果离开模型后再进入传统工具的次数。对普通创作者,这比单张样片的观感更接近日常效率。

但交付只完成了一半。三个消费端入口意味着产品可以获得真实使用反馈,API仍为未来时则意味着团队尚不能把它当作稳定基础设施。订阅、地区、额度与水印规则也会直接影响采用范围;这些缺口比“榜单第二”更能决定企业是否进入采购评估。

两项Arena第二名提供了有价值的相对坐标,却不是厂商主张的通行证。若后续独立测试无法复现文字、事实准确性和局部保持,Image 2.0仍可能是偏好榜单很强、生产边界不清的消费产品。反过来,如果API给出清晰价格与稳定性数据,并且细分能力经得起复测,它才会从Grok内的Quality Mode扩展为可编排的图像服务。

下一轮证据应从哪里出现

最先要等的是API文档,而不是另一段演示视频。模型ID、开放日期、调用格式、计费、并发和地区清单一旦出现,开发者交付状态才会发生可验证迁移。若官方继续只写coming soon,就应保持“尚未开放”的表述,不用传闻补日期。

消费端需要补齐资格矩阵:免费用户、不同付费层级、企业账户分别能否使用Quality Mode,每周或每日额度是多少,是否存在地区差异。公告中的“三类入口”只描述客户端种类,不等于三类入口中的每个账户都有相同权限。

评测侧则应拆出文字拼写、多语言版式、世界知识、局部保持、多参考图身份一致性和连续编辑退化。Arena排名继续变化时,应同时记录配置名、赛道、抓取日期与误差区间。只有这些指标和真实工作流数据同时出现,Image 2.0的“real work”定位才会从厂商口号变成可核验的产品结论。