本文要点
- 官方传播从8月7日产品页延伸到8月8日Grok账号介绍。
- Quality Mode在网页、iOS和Android的正式可用范围得到明确。
- API仍停留在coming soon,开发者交付层没有完成。
阅读辅助
先看数字、证据和来源,再读正文。
8月8日新增是官方账号介绍,承载正式可用状态的发布页日期为8月7日。
2026-08-07 · xAI发布页承载Image 2.0的正式可用状态,页面与JSON-LD均标注8月7日。
产品状态矩阵:先分清可用层级
这条更新适合先看状态,而不是先看效果形容词。xAI在8月7日发布的产品页承载正式可用信息;Grok官方账号在北京时间8月8日11:30发出“Announcing Imagine Image 2.0”,把页面带进本期窗口。后一个动作是官方介绍和传播,不是模型在次日再次上线。
官方原句为:“Imagine Image 2.0 is now generally available as the new Quality Mode on grok.com/imagine, and our iOS and Android apps.”这里的now generally available只覆盖句中明确列出的网页、iOS与Android三个消费端入口。页面紧接着写:“API access is coming soon.”动词仍是未来时,意味着开发者接口尚未被这份公告宣布为可用。
| 对象 | 截至本期的状态 | 原文或证据 | 报道边界 |
|---|---|---|---|
| xAI产品页 | 8月7日承载正式可用状态 | now generally available | 页面日期不能当作精确上线时刻 |
| Grok网页端 | Quality Mode正式可用 | grok.com/imagine被明确列出 | 未披露免费或付费资格 |
| Grok移动端 | iOS与Android正式可用 | 两个平台被逐项列出 | 未披露国家、地区和额度 |
| Grok on X | 状态未说明 | 公告没有列入入口范围 | 沉默既不证明可用,也不证明不可用 |
| Image 2.0 API | 尚未开放 | API access is coming soon | 没有日期、模型ID、价格与调用文档 |
| Arena评测 | 两个指定赛道暂列第二 | low配置进入文生图与单图编辑榜单 | 动态偏好榜单不是全能力验收 |
因此,面向普通用户可以写“消费端Quality Mode已正式可用”,面向开发者只能写“API即将推出”。公告也没有说明所有用户免费可用、全球无地区限制,或已经在X内的Grok入口全量开放。把“generally available”扩大成这些结论,会越过原文的对象范围。
日期、动词与来源各证明一件事
这次材料有一个容易被搜索结果掩盖的时间差。xAI News索引和产品页都把条目标为8月7日,而Grok官方帖的可核时间是北京时间8月8日11:30。前者回答“承载产品状态的页面是哪一天”,后者回答“本期窗口新增了哪一次官方传播”。产品页的JSON-LD把发布日期规范化为零点,但零点只适合确认日历日期,不能当作服务在该时刻切换的运维记录。
两处官方材料承担的证据职能也不同。产品页能证明三个消费端入口、功能清单、最多5张参考图以及API的未来时状态;Grok帖子能证明8月8日发生了正式介绍,并能证明厂商用了“precision editing”“crisp text rendering”和“improved factuality”等措辞。帖子没有写API,不能用它覆盖页面里的coming soon;页面没有给订阅矩阵,也不能从“正式可用”推导每个账户都已获得权限。
Arena是独立于厂商的榜单来源,但它只承担排名证据。它能证明抓取时某个明确配置在两个明确赛道中的相对位置,不能替xAI证明所有细分能力。The Decoder则是窗口内媒体交叉来源,确认公开报道确实围绕榜单和编辑工具展开;它没有发布自己的复现实验,因此不能把媒体转述再包装成第二套性能验证。
FAQ处在更外围。它能说明Grok Imagine环境中的水印和持续审核规则,帮助读者判断产物能否直接进入商业流程,却不能证明Image 2.0的上线日期、访问资格或新模型效果。把每个来源限制在它能证明的范围内,结论就会保持稳定:8月7日页面记录消费端正式可用,8月8日官方账号进行介绍,API仍待未来公告。
Quality Mode装入了哪些创作动作
xAI把Image 2.0描述成面向“real creative work”的生成与编辑模型,产品页重点不只是一轮文生图,还包括选区编辑、组合素材和版式处理。Magic Wand用于指向局部,segmentation负责更精细地选择区域;背景移除可导出透明背景素材;智能扩图允许选定宽高比后补全画面。
多参考图编辑一次最多接受5张输入图。这一上限把人物、商品、风格和场景参考放进同一次生成,但官方没有公布不同订阅层级是否共享同样额度,也没有给出输入分辨率、输出分辨率、失败率或排队时延。页面同时介绍模板化工作流,却未逐项给出独立上线时间和资格条件。
| 能力 | 官方说明能够支持的结论 | 仍缺的生产证据 |
|---|---|---|
| Magic Wand与分割 | 可以选择局部区域并定向修改 | 非目标区域的保持率、边缘误改率 |
| 背景移除 | 可以导出透明背景主体 | 发丝、半透明物体与复杂边缘质量 |
| 多参考图 | 单次最多输入5张参考图 | 身份一致性、冲突素材处理和额度 |
| 智能扩图 | 可按目标比例补全画面 | 构图连续性、长边分辨率和稳定性 |
| 文字与版式 | xAI称小字更清晰、复杂版式更稳 | 多语言拼写、长文本和品牌规范测试 |
Grok官方帖还使用了“crisp text rendering”“improved factuality”和“real world usefulness”。这些是厂商对模型效果的主张,可以忠实转述,却不能在没有细分测试时改写成已被独立证实。尤其是图像“事实准确性”涉及物体关系、世界知识、文字内容和场景约束,单个总体偏好分数无法覆盖全部维度。
消费端还有两条通用边界。xAI FAQ说明生成图片与视频包含Grok水印,且没有移除设置;开启NSFW也不会关闭内容审核,部分内容始终禁止。这些规则能帮助理解Grok Imagine的产品环境,但FAQ没有补充Image 2.0的订阅层级、地区、专属额度或API日期,不能拿通用说明填补本次发布的空白。
两个第二名如何解读
Arena官方榜单在本期抓取时显示,grok-imagine-image-2.0 (low)在Text-to-Image Overall以1320 ±12暂列第2名;第一名gpt-image-2 (medium)为1380 ±5。在Single Image Edit赛道,前者以1439 ±8暂列第2名,后者为1463 ±4。
这里有三层限定。其一,low是Arena显示的模型配置标签,不是“低质量模型”或本文的低置信度。其二,榜单衡量的是特定赛道内的人类相对偏好,分数与名次会随着新增投票和参评模型变化。其三,两项第二名可以说明Image 2.0在总体生成偏好和单图编辑偏好上处于前列,却不能单独证明文字准确率、事实性、多轮一致性或局部编辑保持率。
The Decoder在8月8日的跟进报道也把重点放在“位于GPT-Image-2之后”和新增编辑工具上。这提供了独立媒体对榜单位置与产品功能的交叉核对,但报道本身仍主要引用xAI与Arena,没有增加一套可复现的文字、事实准确性或企业生产稳定性测试。
消费端交付之后,开发者还在门外
Image 2.0当前完成的是消费端产品交付:用户能在网页与双移动端选择新的Quality Mode,使用选区、多参考图、扩图与模板完成操作。它还没有完成开发者交付,因为公开材料没有Image 2.0的API模型ID、输入输出格式、计费单位、并发限制、错误码和正式开放日。
这个差别决定了能力能否进入稳定工作流。消费端适合人工试做海报、商品图和社交素材;API开放后,团队才可能把素材库检索、批量变体、审核、版本管理与重试接成自动管线。即使API上线,生产判断还需要成功率、单图成本、尾部时延、可复现性和内容治理记录,不能由消费端体验或Arena排名代替。
北京时间8月9日00:27,Elon Musk账号继续传播局部选择与即时编辑演示。这是窗口内的产品展示信号,可以帮助确认xAI正强调“可编辑”而非只强调“能生成”;它不改变发布页的入口范围,也不把coming soon推进成API已开放。
Image 2.0最值得关注的变化,是xAI把图像产品的叙事从一次生成推进到消费端编辑工作流。选区、多参考图、透明背景与扩图都指向同一目标:减少生成结果离开模型后再进入传统工具的次数。对普通创作者,这比单张样片的观感更接近日常效率。
但交付只完成了一半。三个消费端入口意味着产品可以获得真实使用反馈,API仍为未来时则意味着团队尚不能把它当作稳定基础设施。订阅、地区、额度与水印规则也会直接影响采用范围;这些缺口比“榜单第二”更能决定企业是否进入采购评估。
两项Arena第二名提供了有价值的相对坐标,却不是厂商主张的通行证。若后续独立测试无法复现文字、事实准确性和局部保持,Image 2.0仍可能是偏好榜单很强、生产边界不清的消费产品。反过来,如果API给出清晰价格与稳定性数据,并且细分能力经得起复测,它才会从Grok内的Quality Mode扩展为可编排的图像服务。
下一轮证据应从哪里出现
最先要等的是API文档,而不是另一段演示视频。模型ID、开放日期、调用格式、计费、并发和地区清单一旦出现,开发者交付状态才会发生可验证迁移。若官方继续只写coming soon,就应保持“尚未开放”的表述,不用传闻补日期。
消费端需要补齐资格矩阵:免费用户、不同付费层级、企业账户分别能否使用Quality Mode,每周或每日额度是多少,是否存在地区差异。公告中的“三类入口”只描述客户端种类,不等于三类入口中的每个账户都有相同权限。
评测侧则应拆出文字拼写、多语言版式、世界知识、局部保持、多参考图身份一致性和连续编辑退化。Arena排名继续变化时,应同时记录配置名、赛道、抓取日期与误差区间。只有这些指标和真实工作流数据同时出现,Image 2.0的“real work”定位才会从厂商口号变成可核验的产品结论。