#Gemini
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 产品上新2026-08-27 · 周四重要度 4/5
Google发布Gemini 3.5 Transcribe
Google 8月26日发布Gemini 3.5 Transcribe,提供流式和预录音频两类API,并称支持85种以上语言。
- 语音模型的重点从转写准确率扩展到交互入口。
- Google把它放进Gemini app、Gboard、AI Studio和Antigravity,说明语音正在变成Agent发起任务的输入层。
- 产品上新2026-08-14 · 周五重要度 3/5
Google Sheets canvas把表格变成交互小应用
Google在8月13日发布Sheets canvas,用户可让Gemini基于表格数据生成交互式mini-app。该功能把表格分析、可视化和轻量应用生成放进Workspace入口。
- 这类更新的价值不在炫技,而在让非工程用户把表格直接转成可操作界面。
- 风险同样清楚:数据权限、生成逻辑可审计性和业务规则错误会决定企业采用速度。
- 模型发布2026-08-14 · 周五重要度 5/5深度报告 →
Google发布Gemini 3.7 Flash工作模型
Google在8月13日发布Gemini 3.7 Flash,定位为面向编码、知识工作、网页开发和智能体的工作模型;API引导价只持续到2026年底。
- Flash线的定位正在从便宜快模型转向日常代理工作模型。
- 半价促销结束后,编码、网页生成和企业流程里的单位成功任务成本会决定留存。
- 行业动态2026-08-06 · 周四重要度 5/5深度报告 →
Google宣布Hassabis将转任DeepMind主席
Google 于8月5日宣布,Demis Hassabis将不再负责Google DeepMind日常运营,转任Google DeepMind主席兼Alphabet首席科学家;Koray Kavukcuoglu将升任Google DeepMind高级副总裁。
- 当天的变化是领导职责重新拆分。
- 研究与AGI议程被单列为Hassabis的战略职责,模型开发
- 工程实践2026-08-01 · 周六重要度 3/5深度报告 →
7月30日跟进|Chrome AI 安全流水线引发高热讨论
Chrome 安全团队的 7 月 30 日文章在窗口内登上 HN 高热讨论。官方称 Chrome 149 与 150 合计修复 1072 个安全问题,超过此前 23 个里程碑总和。
- 新增事件是社区对一篇窗外六小时文章的集中讨论,不是文章再次发布。
- 值得关注的是 AI 已覆盖发现、分诊、候选修复、测试与发布节奏。
- 研究报告2026-07-24 · 周五重要度 5/5深度报告 →
Google ATLAS 覆盖 1500 万次 AI 交互
Google 于 7 月 23 日发布 ATLAS v1.0,汇总 1500 万次去标识化交互。样本覆盖 150 多个国家、140 种语言、800 个职业与 4000 项任务。
- ATLAS 把 AI 采用讨论推进到任务层,但样本只来自 Google 自有产品。
- 它适合观察用途结构,不适合直接估算全体劳动者采用率或生产率。
- 行业动态2026-07-23 · 周四重要度 5/5深度报告 →
Alphabet 财报:Cloud 增长 82%,Gemini 月活 9.5 亿
Alphabet 二季度营收同比增长 24% 至 1198 亿美元,Google Cloud 收入同比增长 82% 至 247.68 亿美元。Gemini 应用月活达到 9.5 亿。
- 这份财报把 AI 从投入叙事推入经营结果:基础设施和企业方案同时拉动云收入。
- 仍需区分 AI 的直接贡献与 Cloud 其他业务增长,官方没有拆出单独收入。
- 模型发布2026-07-22 · 周三重要度 5/5深度报告 →
Google 推出两款 Flash,Cyber 仅预告试点
Google 正在推出 Gemini 3.6 Flash 与 3.5 Flash-Lite,并开放开发入口。3.5 Flash Cyber 尚未普遍可用,只将很快通过 CodeMender 限量试点提供。
- 同一公告实际包含两个当前上线状态和一个未来试点状态。
- 产品线开始按质量、成本与网络安全任务分层,但 Cyber 的实效尚不能按正式发布评估。
- 产品上新2026-07-17 · 周五重要度 4/5深度报告 →
Google 将 NotebookLM 更名 Gemini Notebook
Google 官方博客于 7 月 16 日 16:00 UTC 发布更名消息,NotebookLM 改为 Gemini Notebook。HN 同步形成 371 分讨论。
- Google 把独立知识笔记工具纳入 Gemini 品牌体系。
- 后续要观察产品能力、数据边界和 Workspace 入口是否随品牌整合一起改变。
- 观点观察2026-07-11 · 周六重要度 3/5
社区待验证|Google AI Forum 高热帖反对停用 Gemini 2.5 Flash
Google AI 开发者社区 7 月 10 日出现单帖高热,请求不要停用 Gemini 2.5 Flash,讨论集中在成本和迁移稳定性。
模型生命周期管理正在变成平台信任问题。开发者不只看新模型分数,也看低价、低延迟、稳定版本能否被保留足够久。
- 模型发布2026-07-01 · 周三重要度 5/5深度报告 →
DeepMind 双发 Nano Banana 2 Lite + Gemini Omni Flash:把生成式媒体价格砍到 $0.034/图与 $0.10/秒,头部模型价格战全面引爆
Google DeepMind 在 24 小时内发布两款生成式媒体模型:Nano Banana 2 Lite(Gemini 3.1 Flash-Lite Image,文生图 Arena 1251 分排名第 5,$0.0336/1K 图、单图 <4 秒,Batch 价 $0.0168);Gemini Omni Flash(文生视频与视频编辑,视频编辑 Arena 1347 分排名第 2,领先第 3 名 HappyHorse 1.0 约 40 分,$0.10/秒 720p,等价于 Veo 3.1 Fast)。两款模型均已通过 Gemini API + Google AI Studio 上线,正式挑战 OpenAI Sora 2 / GPT Image 1.5、Midjourney、Runway 等生成式媒体头部位置——同时把生成式媒体的边际成本砍到接近商品化的水位。
- DeepMind 双发的真正信号不是『又出两个模型』,而是把生成式媒体的『价格锚点』重置:Nano Banana 2 Lite 单图 $0.034 与 Veo 3.1 Fast 视频 $0.10/秒,把生成式媒体从『按次付费的稀缺品』推向『按 token 计价的基础设施』。
- Arena 排名不是关键
- 产品上新2026-06-29 · 周一重要度 3/5
Google AI Studio 官方免费开放 100 万 token/分钟,登录即用,无需信用卡
据 EngMoElgaraihy 6-28 22:12 UTC 推文(823 赞)转述:Google AI Studio 官方免费开放每分钟 100 万 token、零限制,无需信用卡、无需订阅,登录即可使用——原本价值数千美元/月的开发者算力被零门槛免费送出。
- 这是 Google 在开发者侧的极端压力测试。
- 同期 Gemini API 商业化定价、Anthropic Claude / OpenAI ChatGPT 都还在按 token / 包月收费,'免费 + 100 万 token / 分钟'对独立开发者、学生、初创团队几乎等于全量免费
- 行业动态2026-06-29 · 周一重要度 5/5深度报告 →
Google 把模型访问条款做成对 Meta 的竞争武器:平台 gating 时代来了
据英国《金融时报》首报、CNBC 等跟进(2026-06-28 北京时间),Google 通过旗下 Gemini API 的服务条款,首次以『纯商业动机』明确限制直接竞争对手 Meta 使用其 Gemini 系列大模型——这是大厂间『通过模型 API 条款压制对手』的第一次被主流财经媒体实锤;HN 当日相关条目斩获 156 分、72 条评论。条款战事发于平台 gatekeeping 的灰色地带:Google 2026 年更新的 Cloud / Generative AI API 使用条款早已暗含『禁止使用本服务开发与本服务直接竞争的模型或服务』的措辞,FT 报道的突破在于,它把这种『条款武器』,落地到了一个具体的、有名字的对手身上。当下 Meta 的 Llama 系列与 Google 的 Gemini 形成正面竞争,Meta 内部署的『Gemini-for-X』超大规模用例可能首当其冲。事情因此从『一家商业条款的法律问题』,升级为『平台层 AI 竞争的反垄断悬剑』——美国 FTC、欧盟 AI Office、英国 CMA 的 AI 厂商『拒绝供应对手』调查已经在路上。本文深度分析:条款武器长什么样、对 Meta 的实际冲击、反垄断与监管视角、对整个 LLM 平台层格局的影响。
- 产品上新2026-06-26 · 周五
Google 在 Gemini 3.5 Flash 中加入 Computer Use
Google 发布 Gemini 3.5 Flash 的 computer use 能力,把屏幕操作/agentic 控制下放到低价快速档,登上 HN(241 分/167 评论)。
- 把 computer use 放进最便宜的 Flash 档,意味着"让 agent 直接操作屏幕"正从旗舰能力变成默认能力,价格敏感的批量自动化场景首次有了可负担选项。
- 这与 OpenAI Terra/Luna 压价
- 研究论文2026-06-24 · 周三重要度 4/5深度报告 →
PlanBench-XL:1665 个工具的长程规划评测,前沿模型在「静默失败」前集体失灵
UIUC 团队提出交互式长程规划基准 PlanBench-XL:327 个零售任务、1665 个工具、56 种数据类型,工具需检索动态发现,平均约 25 轮、最短解 5–9 次调用。Gemini-3.1-Pro 最强(77.06%),GPT-5.4 默认 51.90% 但在最严重阻塞下崩到 11.36%,最小模型为 0%;探索度与准确率强相关(r=0.902),「静默失败」危害最大。
- 行业动态2026-06-22 · 周一重要度 3/5
ChatGPT 全球助手份额首次跌破 50%,Gemini/Claude 追赶
据 Sensor Tower《2026 AI 现状》报告(TechCrunch 6 月 16 日转述),到 5 月底 ChatGPT 全球 AI 助手份额首次跌破 50%、降至 46.4%(年初仍高于 50%),Gemini 升至 27.7%、Claude 10.3%。ChatGPT 月活仍超 11 亿,据称是史上最快达 10 亿用户的应用。
- 份额跌破 50% 是个心理与叙事拐点,但要分清『份额』与『绝对量』:ChatGPT 月活仍在创纪录增长,跌的是相对占比
- 意味着市场在做大、对手在更快地分蛋糕。