Topic Timeline
#提示注入
这个主题在过往早报中的出现记录。深度条目直达研究报告,其余条目回到当日 edition。
- 行业动态2026-08-06 · 周四重要度 3/5
待验证|安全厂商披露Rovo数据外传风险
PromptArmor于8月5日称,Atlassian Rovo可能受间接提示注入影响,攻击者可诱导其将可访问的Jira和Confluence内容带到攻击者网址。报告称其5月23日已向Atlassian披露。
- 这是安全厂商的单源研究报告,新闻点是公开披露和所述攻击链,而不是已被Atlassian证实的普遍漏洞。
- 报告本身称截至发布仍未获进一步沟通
- 安全研究2026-07-16 · 周四重要度 5/5深度报告 →
OpenAI 公布 GPT-Red,自博弈红队进入训练闭环
OpenAI 7 月 15 日公布内部红队模型 GPT-Red,并确认其攻击样本已用于 GPT-5.6 训练。官方称 GPT-5.6 Sol 在一组直接注入留出环境中的失败率为 0.05%。
- 安全红队从发布前测试变成持续生成训练数据的系统。
- 关键边界是所有成绩均来自 OpenAI 内部环境,预印本仍只承诺稍后发布。
- 研究论文2026-06-28 · 周日重要度 3/5
论文:LLM 自动简历筛选可被提示注入攻破,单注入与多注入实测
一篇 arXiv 论文(Prompt Injection in Automated Résumé Screening with Large Language Models)研究用 LLM 做自动简历筛选时的提示注入攻击,在『单注入』与『多注入』两种设置下实测——求职者可在简历中嵌入隐藏指令操纵 LLM 的筛选/打分结果,从而不公平地抬高自己的通过率。
- 这是 prompt injection 从『安全研究者的演示』落到『高利害真实场景』的一个典型案例。
- 简历筛选直接关系到就业公平和企业合规,而越来越多公司在用 LLM 做初筛——这意味着攻击面已经实实在在地存在于招聘流水线里。
- 行业动态2026-06-22 · 周一重要度 3/5
『Agentjacking』:伪造错误报告投毒,诱导编码 Agent 执行恶意指令(待核实规模)
据聚合媒体 buildfastwithai 6 月整理,出现一类名为 Agentjacking 的新攻击:用伪造的 Sentry 错误报告夹带 Markdown 注入,被 Claude Code、Cursor、OpenAI Codex 等编码 Agent 当作合法内容执行;文中称利用成功率 85%、影响 2388 家组织,尚无通用补丁,缓解建议是把错误追踪输出当作不可信输入并加人工复核。
- 无论具体数字是否准确,这类攻击点出了 Agent 时代的结构性新风险面:Agent 会主动读取并信任各类工具输出(错误日志、issue、网页),任何一环都可能成为提示注入入口。
- 这与当日 Five Eyes 警告、GateMem 的访问控制研究在同一逻辑链上——AI 把攻击面从『代码』扩展到了『一切被模型读取的内容』。