HP 试点 Frontier 单工程师产出
OpenAI 官博自报(试点阶段),未披露具体时间窗;作为 Frontier 接入企业实际产能的对照样本
来源:OpenAI 官方博客过去 24 小时,模型发布暂缓期让位给一组更长期、更基础的变化:平台条款、企业落地、物理供给、人事流动同时进入加速带。OpenAI 把 Frontier 战略合作的第一个全企业客户交给 HP,把模型 + 上下文 + 治理打包成’连接层’,验证 Frontier 不再是单点 demo 而是可以在复杂分布式企业里把 agent 从实验推到生产管线的’运营操作系统’;Coinbase 一句话把 GLM 5.2 / Kimi 2.7 设为默认,把 LibreChat 缓存命中率从 5% 拉到 60%,验证了’开源权重 + LLM 网关 + 缓存’是企业 LLM 成本公式;Meta 在 Nature 上发表 Brain2Qwerty v2,把非侵入式脑机接口从字符级跃迁到词与语义级,代码与 v1 数据集同步开源;贾扬清离开被收购仅一年的英伟达,SemiAnalysis 直言 DGX Lepton’远未达到 Jensen 预期’,猜测涉及开源承诺分歧;DeepSeek V4 直接出正式版、跳过 2 个月预览,并首次主动引入高峰 2 倍定价,把 SaaS 行业’高峰期上浮、低谷期补贴’的现成范式复制到 LLM API;Google 据 FT 限制 Meta 用 Gemini,首次被主流财经媒体实锤的’API 条款武器’,反垄断悬剑已在路上。
这一组事件都不是新模型上线,但它们都在改写’谁有模型 ≠ 谁赢了’的格局。下半年的 AI 竞争主轴,从参数规模、价格梯度转向三个更深层的变量:平台条款(谁能用条款卡住对手供给)、企业落地(谁能用 Frontier / 联网 LLM 网关把 agent 推到生产)、物理资源与关键人物(谁先撞到 HBM 墙、谁在明星收购整合上踩坑)。三道墙叠在一起,头部厂商的下一阶段较量,不再是参数数字,而是这三条暗线的加速。
OpenAI 官博自报(试点阶段),未披露具体时间窗;作为 Frontier 接入企业实际产能的对照样本
来源:OpenAI 官方博客Brian Armstrong 自报;在 token 用量指数级增长同时实现支出平稳,具体拆解未公开
来源:Brian Armstrong X 推文(经 PANewsCN 中文转述) →以下内容仅作为追踪线索,不与已核验新闻等量呈现;正式文件、项目材料或独立复核出现后再升级。
trotsky1997/OpenFugu(GitHub,305★):Sakana AI Fugu LLM orchestrator 开源复现,覆盖读 → 运行 → 训练 → 服务全流程。
社交雷达 · X 讨论
- Meta 发布非侵入式脑机接口研究重大进展 Brain2Qwerty v2,登 Nature。
- 基于 v1 升级,首个能实时从原始脑信号解码整句的端到端流水线,从字符级跃迁到词与语义级。
- 9 名志愿者 MEG 打字 10 小时共约 22,000 句,平均词准确率 61%,最佳受试者 78%,>50% 句子解码错误 ≤1 词,性能随数据量对数线性扩展。
原帖 ↗- DeepSeek V4 正式版将于 7 月中旬发布,不再是 2 个月的预览版。
- 预期需求旺盛,因此引入高峰时段定价机制:高峰期价格为现行 2 倍,基础价格保持不变。
- 这是国产开源权重派首次主动做供给侧时段分层。
原帖 ↗- Coinbase 通过 LLM 网关将智谱 GLM 5.2
- 月之暗面 Kimi 2.7 等开源权重模型设为默认选项,结合路由和缓存优化,在 token 用量持续增长的同时将 AI 支出削减近半。
- LibreChat 缓存命中率从 5% 升至 60%。
- 91% 员工从未触及用量上限,因此选择'更好的默认值'而非降速。
原帖 ↗- 前 Facebook/阿里副总裁、LeptonAI 创始人兼 CEO、英伟达系统软件副总裁贾扬清已从英伟达离职。
- 距离黄仁勋 7 亿美元收购这家仅 20 人的团队才过去约一年。
- SemiAnalysis 称 DGX Lepton 运营效果不及黄仁勋预期,更深层原因涉及开源承诺分歧与产品落地执行力,黄仁勋可能推翻了 DGX Lepton 的开源决定。
- 贾扬清已出任 GPU 创业公司 Hyperbolic 顾问。
原帖 ↗- 谷歌向开发者敞开大门:Google AI Studio 官方免费开放每分钟 100 万 token、零限制,无需信用卡、无需订阅,登录即可使用
- 原本价值数千美元/月的算力免费开放。
原帖 ↗- 百度已成 AI 行业全栈玩家:自研芯片、文心一言模型、云系统、Apollo Go 自动驾驶业务。
- Baidu CFO Henry He 在 Odd Lots 播客讨论如何用 AI 改造组织架构并吸引新人才。
原帖 ↗更多讨论6 条
- BINEVAL 论文介绍 LLM-as-Judge 新方法:把每个评估维度拆解成原子级是非题,逐项独立回答后聚合为多维分数,可逐题追溯失分原因并直接反馈给 prompt 改进。
- 在 SummEval/Topical-Chat/QAGS 上无需训练即匹配或超过 UniEval 和 G-Eval,在事实一致性上尤其强。
原帖 ↗- GLM 下一版本社区调研:评论区几乎被 vision 和 token efficiency 相关反馈占据。
- jietang 发起提问'下一代 GLM 必须有什么新特性',呼吁讨论专门能力。
原帖 ↗- 腾讯被曝与长鑫存储签署超 200 亿元服务器 DRAM 供货合同,字节跳动、阿里云、小米、联想也在与长鑫洽谈更多芯片采购。
- 长鑫是中国规模最大 DRAM 存储芯片厂商,被视为中国版 SK 海力士/美光,正在加速扩产。
原帖 ↗- Musk 财技一流:把 xAI 塞进 SpaceX,OpenAI 和 Anthropic 融资将变难、上市更难、流动性被抽干只能延期。
- 趁此时搞定 TSLA 老股东,把 TSLA 合并进 SpaceX 换股,SpaceX 营收增 900 亿美元,PS 从 110 降到 30 多(只比 NVDA 高一点)再叠加太空叙事,星链与火箭政府订单上去后 PS 可降至 20 以下,几万亿市值合理。
原帖 ↗- 全球最知名独立开发者 levelsio 是 Cursor 早期投资人,B 轮投了 10 万美金。
- Cursor 刚被 SpaceX 以 600 亿美元收购,他成功退出,投资组合价值已达 1000 万美金。
原帖 ↗- 技术选型讨论:服务器端应该暴露 MCP,还是直接用 SKILLS+CLI?
- 感觉后者正慢慢成为主流,MCP 似乎没什么优势,只剩'自动更新工具发现机制'这一项 SKILL 没有。
原帖 ↗