Topic Timeline
#可解释性
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 观点观察2026-08-15 · 周六重要度 2/5
待验证|AI by Hand在HN引发手算教学讨论
AI by Hand在HN获得百级讨论,项目用手算方式解释AI概念。由于原站点缺少可识别发布日期,本条只作为社区学习需求信号。
- 当模型能力叙事越来越复杂,手算和可视化教学反而有价值。
- 它提醒工具团队:教育材料的可验证步骤,有时比宣传性demo更能降低采用门槛。
- 研究论文2026-07-07 · 周二重要度 5/5深度报告 →
Anthropic J-space 论文:在 Claude 中间层找到一个「意识工作空间」
Anthropic 发布 J-space 论文:在 Sonnet 4.5 中间层定位到占比≤10% 的「可语言化」表征,纯 J-lens 替换 88% 命中,组件替换 59%,屏蔽后多步推理几乎归零。
- 这篇论文把 Global Workspace Theory 这种神经科学级假说,变成一个可在开源权重模型上独立复现的工程对象。
- 真正决定安全含义的是 6–7% 中位方差、上限不超过 10%——Claude 真正在『思维』的部分不到十分之一。