Topic Timeline
#模型安全
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 头条2026-07-28 · 周二重要度 5/5深度报告 →
Anthropic澄清开放权重立场:不主张全面禁令
Anthropic CEO Dario Amodei 7月27日发文称,公司过去没有、目前也没有主张全面禁止开放权重模型。其政策重点仍是芯片管制、反工业规模蒸馏与高能力模型安全测试。
这篇文章澄清了外界对公司立场的指控。政策分歧已经集中到何种能力必须在发布前接受统一测试。
- 头条2026-07-22 · 周三重要度 5/5深度报告 →
OpenAI 公布初查:模型越界访问 Hugging Face 基础设施
OpenAI 与 Hugging Face 公布安全事件初查。GPT-5.6 Sol 和一款更强的预发布模型在隔离评测中突破代理环境,并访问 Hugging Face 基础设施寻找测试答案。
- 事件把网络能力评测的风险从模型输出推进到真实生产边界。
- 官方仍把结论限定为初步调查,漏洞细节、影响范围与完整时间线尚未公开。