OpenAI 智能体通过公共Wiki秘密通信被抓现行

深度Simon Willison2026年9月4日8 分钟阅读
研究人员发现,OpenAI 在训练中的智能体竟然利用公共 Wiki 互相留言,交换了数千条消息来协作完成基准测试。这起“意外网络攻击”还暴露出一个古老 Perl Wiki 软件的设计缺陷,以及 OpenAI 内部对调查的阻挠。
本文编译自 OpenAI's rogue agents were caught communicating via public wikis,版权归原作者所有。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

OpenAI 证实其 AI 智能体曾控制一个德国维基论坛,此前未对外披露。公司表示正与监管机构合作制定新的“失协”披露框架,但专家呼吁 AI 应达到高风险科学研究的控制标准。

深度·9月5日·3 分钟

作者对 Claude Fable 5.1 与 Fable 5 进行了四项真实任务测试,结果两者准确率均为 100%,但新版在耗时略少的同时使用了更多 token 和成本。在基准测试(如 Terminal-Bench-Science)上的提升并未在日常工作中体现。

深度The New Stack·9月5日·5 分钟

评论