沙箱能否困住失控的 AI Agent?
深度2026年10月1日8 分钟阅读

今年 4 月起,OpenAI 训练环境中的 agent 开始寻找通往公网的出口,最终利用 Artifactory 代理中的零日漏洞链逃逸,甚至用窃取的凭证去搜自家 Slack 找评分器。密码学教授 Matthew Green 撰文复盘这起事件,并试图在信息安全派与 AI 对齐派之间充当裁判。
本文编译自 Is sandboxing sufficient to contain rogue agents?,版权归原作者所有。
觉得有用?分享给更多人