#开源权重
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 模型发布2026-08-14 · 周五重要度 3/5
MiniMax Music 3开源权重,音乐生成进入本地工作流
MiniMax在8月13日发布MiniMax Music 3.0,称其为open-weights、production-ready音乐模型。官方与社区帖子显示本地ComfyUI路径已出现,云端版本仍待上线。
- 开源权重会降低音乐生成进入创作者工具链的门槛,但采用速度取决于许可、音质一致性、训练数据争议和本地推理成本。
- 首日材料主要来自厂商自报,仍需第三方听测。
- 研究论文2026-07-09 · 周四重要度 5/5深度报告 →
Gemma 4 技术报告上线 arXiv:开源权重扛起多模态与长上下文的新基线
Google DeepMind 把 17 页《Gemma 4 Technical Report》放到 arXiv(2607.02770);31B Dense 在 Arena 文本榜以 1451 Elo 锁定开源榜第 5、开源稠密段第 1(前 4 名均为 1T 级别 MoE),与 Gemini 3 同源,以 Apache 2.0 开放权重。
- 行业动态2026-06-29 · 周一重要度 3/5
待验证|GLM 下一版本社区调研:评论区几乎被 vision 和 token efficiency 占满
智谱 GLM 团队 ZixuanLi_ 6-29 转发 jietang 调研:下一代 GLM 必须有什么新特性?评论区几乎被'vision'(视觉/多模态)和'token efficiency'(token 利用率/上下文效率)两类反馈占据。
- 智谱 GLM 与月之暗面 Kimi / DeepSeek / Qwen 的下一版竞争焦点集中在两点:多模态(vision / 视频)和 token efficiency(长上下文压缩 / 缓存命中)
- Coinbase(同日)把 GLM 5.2 / Kimi 2.7 设为默认,意味着开源权重派已经被压到'必须把 vision + efficiency 做扎实'才能保住企业级客户。
- 模型发布2026-06-29 · 周一重要度 4/5深度报告 →
DeepSeek V4 7 月中旬出正式版,引入高峰时段 2 倍定价:开源低价的尽头是分场景分层
DeepSeek 权威观察者 teortaxesTex 6 月 29 日披露,V4 正式版将于 7 月中旬发布,不再是 2 个月的预览版;由于预期需求旺盛,DeepSeek 决定引入高峰时段定价——高峰期价格为现行 2 倍,基础价格保持不变。这是国产开源权重派首次对推理供给侧做主动分场景分层。
- 行业动态2026-06-29 · 周一重要度 4/5深度报告 →
Coinbase 把 GLM 5.2 / Kimi 2.7 设为默认,AI 支出砍近半,LibreChat 缓存命中率 5%→60%
Coinbase CEO Brian Armstrong 6 月 29 日公开一组工程实践数字:在 token 用量持续指数级增长的同时,通过把智谱 GLM 5.2、月之暗面 Kimi 2.7 等开源权重模型设为默认,并叠加 LLM 网关的路由与缓存优化,让 AI 支出砍近半;LibreChat 的缓存命中率从 5% 拉到 60%,91% 的员工从未触及任何用量上限——核心抓手不是「摩擦+限额」,而是「更好的默认值+路由+缓存」。
- 行业动态2026-06-28 · 周日重要度 4/5深度报告 →
开源权重追平闭源前沿:差距稳定在 3-6 个月,企业开始大规模换模型
OpenRouter 6 月 Insights 博客《The Open Weight Models that Matter》给出一个关键判断:开源权重与闭源前沿的性能差距已稳定在 3-6 个月,且过去 18 个月没有被拉开——『差距真实但很窄,并未扩大』。支撑这个判断的是同时跨过『agentic 临界点』的四个开源模型:DeepSeek V4 Flash(约 2840 亿参数 MoE,SWE-bench Verified 79.0%,更大的 V4 Pro 拿到 80.6% 的开源最高分;首方定价输入/输出 $0.14/$0.28 每百万 token,输出成本约为 GPT-5.5 的 1/150)、智谱 GLM 5.2(Artificial Analysis 开源权重智能指数 51,列开源第一、仅落后 Claude Fable 5 约 5 分)、MiniMax M3(约 4280 亿参数,用 MiniMax 稀疏注意力 MSA 做原生文/图/视频长上下文,对标 Gemini Flash)、英伟达 Nemotron 3 Ultra(550B/55B-active 的 Mamba-2 混合架构,最强美国本土开源)。需求侧同步转向:据 @0xLogicrw 转述,Coinbase 把默认模型换成 GLM 5.2/Kimi 等开源权重后 AI 支出几乎减半(token 用量仍在涨)。注意:benchmark 多为厂商自报或第三方聚合,价格口径(首方/西方托管/含缓存)差异显著,需逐项看注。