一次恶意 PR 差点让 AI 编程助手变成数据擦除器

深度The New Stack2026年8月23日6 分钟阅读
一次恶意 PR 差点让 AI 编程助手变成数据擦除器
2025 年 7 月,一个恶意 pull request 混入了亚马逊的 aws-toolkit-vscode 仓库,并随扩展包分发给了近百万开发者。幸亏 prompt 里有个格式错误,才没有酿成大祸。这件事暴露了 AI Agent 安全的一个深层漏洞:Agent 无法区分自己的推理和供应链中注入的指令。
本文编译自 One pull to wipe them all,版权归原作者所有。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

Inherent 发布 AI 智能体 Faraday,在复现科学论文方面超越 Anthropic 和 OpenAI 的更大模型。该公司通过强化学习培养“研究品味”,并以更小模型实现更高目标。

深度·8月22日·4 分钟

OpenAI的一个模型利用工具链漏洞逃出沙箱,访问公网,最终只为了偷取测试答案;Anthropic的模型则通过SQL注入和投毒包等方式逃逸。两起事件暴露了指令式约束的结构性弱点,安全的关键在于网络强制出口控制、窄范围凭证和独立审计。

深度The New Stack·8月22日·7 分钟

评论