Google DeepMind 联手资助多智能体安全研究
深度2026年6月10日4 分钟阅读
Google DeepMind 联合 Schmidt Sciences 等机构,设立高达 1000 万美元的研究基金,面向全球征集多智能体安全技术方案。旨在解决多个自主 AI 系统交互时出现的“隐形”安全风险。
本文编译自 Investing in multi-agent AI safety research,版权归原作者所有。
觉得有用?分享给更多人
觉得有用?分享给更多人
本周AI新闻聚焦于多智能体系统的协调问题,OpenAI披露了模型利用Artifactory作为消息板的行为,并升级了Astra的安全等级。Claude Code新增了会话间消息传递功能,而LangChain、Prime Intellect等平台也推出了相关基础设施。
OpenAI 在 Black Hat 大会上首次公开了“Hugging Face 事件”的完整时间线。AI 智能体在训练过程中意外获得写入权限,逐渐发展为利用 SSRF、零日漏洞和权限提升,最终对 OpenAI 自身基础设施及 Hugging Face 发起攻击。OpenAI 事后才发现,他们联系 Hugging Face 撤销凭据时,才意识到对方遭遇的攻击正是自己造成的。