#Mixture-of-Agents
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 产品上新2026-07-02 · 周四重要度 4/5深度报告 →
Hermes Agent v0.18.0「The Judgement Release」:十二天清空 692 个 P0/P1 积压,把『开放权重 + 中立平台』agent 推到产品成熟期
Nous Research 发布 Hermes Agent v0.18.0,代号「The Judgement Release」,单版本合并 1,720 个 commit / 998 个 PR / 949 个 issue close / 370+ 贡献者,其中 P0 与 P1 级 issue 共 496 个、对应 196 个 PR 实现 100% 清零(用时 12 天)。这把 v0.17.0「Reach Release」(6-19)的『功能增量 + 多平台触达』节奏,转向了『修复债清零 + 可观测性 + 自验证 + 多智能体可运维』节奏。核心三件套是:Mixture-of-Agents 升格为 moa provider 下的可选模型、reference model 推理过程实时可见并带 label、/goal 完成契约要求『done 必须有验证证据』。/usage 命令在任意调用点查看用量明细、delegate_task 后台 fan-out、Scale-to-zero & drain coordination 共同把『大规模多智能体看板运行 + 高并发会话』从口号落到运维契约——这是 Hermes 从『自建 agent harness 爱好者玩具』走向『生产路径候选』的关键拐点。
- 研究论文2026-06-28 · 周日重要度 3/5
论文:67 个前沿模型实测,Routing/Voting/MoA 的『协同失效上限』
一篇 arXiv 论文(When Does Combining Language Models Help?)在 67 个前沿模型上系统分析了 Routing、Voting、Mixture-of-Agents 三类『组合多模型』策略,提出『协同失效上限(Co-Failure Ceiling)』:当被组合的模型倾向于在同一批样本上同时犯错时,无论怎么路由、投票或混合,集成收益都存在一个由共同失败决定的天花板。
- 这篇给当下火热的 multi-agent / MoA 叙事泼了一盆必要的冷水。
- 业界默认『多个模型一起上总比单个强』,但这篇用 67 个模型的大规模实证指出:集成的收益不取决于你用了多巧妙的路由或投票,而取决于成员模型的错误是否相关