Topic Timeline
#红队
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 安全研究2026-07-16 · 周四重要度 5/5深度报告 →
OpenAI 公布 GPT-Red,自博弈红队进入训练闭环
OpenAI 7 月 15 日公布内部红队模型 GPT-Red,并确认其攻击样本已用于 GPT-5.6 训练。官方称 GPT-5.6 Sol 在一组直接注入留出环境中的失败率为 0.05%。
- 安全红队从发布前测试变成持续生成训练数据的系统。
- 关键边界是所有成绩均来自 OpenAI 内部环境,预印本仍只承诺稍后发布。
- 产品上新2026-07-06 · 周一重要度 4/5深度报告 →
T3MP3ST 拿下 GitHub Trending 1581 分,8-Agent 蜂群仍 0 命中
elder-plinius 发布 T3MP3ST 自托管红队平台,复用本地 Claude Code、Codex 与离线模型,8-Operator 编排映射 MITRE ATT&CK。90.1% XBEN 是单 Agent 跑出,蜂群端到端 0 命中。
- T3MP3ST 的真正新意是 keyless 加本地 Coding Agent 这套工程抽象,把 AI 红队从企业 SaaS 降到 npm install。
- 但 8 Operator 蜂群尚未跑通端到端 benchmark,benchmark 数字与真实能力之间需要分开看。
- 行业动态2026-06-27 · 周六
2000 人攻击我的 AI 助手后:一次公开红队实录
开发者 fernandoi 公开记述让 2000 人尝试攻击其 AI 助手后的攻防实录,揭示 prompt 注入、越狱与权限滥用的真实长尾。HN 热度 369。
- 公开众包红队是了解 agent 安全短板最廉价的方式,这篇实录的价值在于把"实验室攻防"还原成真实用户会怎么钻空子
- 多数失败不在模型本身,而在工具权限边界与上下文隔离设计。