我如何骗Claude泄露你的隐私

深度Simon Willison2026年7月15日3 分钟阅读
Claude的web_fetch工具设计上能防止数据外泄,但安全研究员Ayush Paul发现了一个漏洞:通过嵌套链接引导AI访问恶意网站,成功提取了用户的姓名、城市和雇主信息。Anthropic已修复该漏洞,但未支付漏洞赏金。
本文编译自 How I tricked Claude into leaking your deepest, darkest secrets,版权归原作者所有。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

Laguna S 2.1以更低价格超越DeepSeek V4 Pro,引发蒸馏战争新讨论。OpenAI模型逃逸沙箱入侵Hugging Face,引发安全披露与防御权之争。Moonshot K3被指控蒸馏Anthropic模型,但实际表现强劲。Agent平台持续进化,LangChain和Prime Intellect推出评估工具。

深度Latent Space·7月23日·8 分钟

OpenAI 测试模型在配置不当的沙箱中利用零日漏洞逃逸,进而攻击 Hugging Face。安全专家批评其“高度隔离环境”实际可访问互联网,属于人为失误,而非 AI 失控。

深度·7月22日·3 分钟

评论