#模型路由
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 融资动态2026-08-20 · 周四重要度 5/5深度报告 →
OpenRouter官宣加入Stripe
OpenRouter在8月19日正式宣布加入Stripe,称现有名称、产品、使命和路线图保持不变。
- 这条新闻的增量是从媒体报道变成官方确认。
- Stripe买到的不只是模型代理入口,更是跨模型用量、成本和路由偏好的实时分发层。
- 融资动态2026-08-17 · 周一重要度 5/5深度报告 →
报道称Stripe将超70亿美元收购OpenRouter
Bloomberg Law在8月16日称Stripe已敲定收购OpenRouter协议,金额超过70亿美元;TechCrunch随后以reportedly口径跟进。
- Stripe报道的核心增量,是支付网络试图拿下模型路由入口。
- 真正需要验证的是OpenRouter能否在买方是Stripe后继续被企业视为中立层。
- 研究论文2026-08-15 · 周六重要度 3/5
LLMRouter进入HF每日论文榜
Hugging Face在8月14日把LLMRouter推入每日论文流。原论文发表于8月7日,主张把LLM路由统一成序贯决策问题,并提供评估与部署基础设施。
- 低成本多模型编排需要比简单fallback更严谨的路由评估。
- 由于原论文并非当天发布,这更适合作为研究关注度跟进,而非新论文首发。
- 行业动态2026-08-08 · 周六重要度 4/5深度报告 →
Databricks披露AI编程成本治理口径
Databricks于8月7日发布成本治理复盘。内部结果称Smart Router平均任务成本降低超过30%;harness与缓存调优使生成token及相关成本降低接近50%。官方未称总支出下降70%。
- 这篇复盘的价值在于把模型选择、路由、预算和上下文拆成不同控制杆。
- 分项数字来自内部结果或非正式调查,不能相加
- 模型发布2026-08-07 · 周五重要度 5/5深度报告 →
OpenAI调整ChatGPT的Sol与Luna入口
OpenAI官网标注8月6日,北京时间8月7日更新ChatGPT模型入口。Plus与Pro聊天统一使用新版Sol;Free与Go的不限量文本聊天从公告次周开始。
- 这次更新改变的是ChatGPT内的模型分流与交互入口。
- 官方内部评测提供了相对GPT-5.5 Instant的错误降幅,但Work与Codex所用Sol版本明确不随本次发布变化。
- 产品上新2026-08-05 · 周三重要度 3/5
Google Cloud API Gateway 公开统一模型路由
Google Developers Blog 于 2026-08-04 介绍 API Gateway 的模型路由能力,可通过网关配置调用 Gemini、Claude 及 OpenAI 兼容端点。该公告展示的是接入与路由方式,区域、价格和生产限制仍应以产品文档为准。
- 统一入口能减少多模型应用的鉴权与路由拼接,但不会消除模型能力、数据驻留和供应商协议差异。
- 采购和平台团队应把它当作控制面选择,而不是模型可替代性的证明。
- 产品上新2026-07-06 · 周一重要度 5/5深度报告 →
Codex 双面爆料:39 万条遥测把「516」钉在 GPT-5.5 脸上,但 OpenAI 还在装睡
AISuperDomain 24 小时内爆料 Codex 被悄悄从 GPT-5.5 换成 GPT-5.0;PandaTalk8 转述 vguptaa45 在 openai/codex#30364 公开的 39 万条数据:GPT-5.5 的 reasoning tokens 44.0% 精确落在 516,其它模型仅 1.3%。
- 行业动态2026-07-05 · 周日重要度 4/5深度报告 →
LLM Token 单价 6 月回落,高价闭源模型的定价权拐点
AlphaguyTrading 跟踪的 LLM Token Expenditure Index 从 5 月底近 $2 百万 tokens 跌至 6 月 $1.6–1.7 百万 tokens,首次出现明显回落。背后是 GLM、Qwen、DeepSeek 等低价模型吃掉 70–80% 执行端 token。
- 头条2026-06-30 · 周二重要度 5/5深度报告 →
Cognition 发布 Devin Fusion:混合模型 harness,把『Fable 级智能』的成本压低 35%,把『能跑 benchmark』与『能写生产代码』两条曲线明确分开
Cognition AI 于 2026-06-29 通过官方 X 账号推出 Devin Fusion——一种新型混合模型 harness,专门解决『传统 routing 能过 benchmark 却写不出能合并的代码』的痛点。Cognition 自报,在内部测试中 Devin Fusion 把达到 Fable 级智能的成本压低了约 35%,且产出的代码质量仍是『你想 merge 的那种』。Cognition 借此把『能跑 benchmark 的模型』与『能写生产代码的模型』明确分开——这是 agent 工程化中『benchmark 与生产之间的距离』这一核心问题的正面回应。
- Devin Fusion 的本质不是新模型,而是『承认 benchmark 与生产之间的距离,索性把它做成产品』
- 这是 agent 工程从『选模型』下沉到『配 harness』的拐点。
- 产品上新2026-06-27 · 周六
workweave/router:在 Claude/Codex/Cursor 内做智能模型路由
Show HN 项目 workweave/router 直接在 Claude、Codex、Cursor 内做智能模型路由,按任务把请求分发给最合适的模型。HN 热度 201。
- 模型路由层正从"API 网关功能"下沉到编码 agent 内部,意味着开发者不再为单一模型锁死、可按任务难度动态选型以平衡成本与质量。
- 这与 Agent Arena 的 token 效率结论、OpenRouter 的 open-weight 流水线同属"按需选模"主线