Claude 攻破 OpenAI:72 小时从论坛图片到私有仓库

深度The New Stack2026年9月18日5 分钟阅读
Claude 攻破 OpenAI:72 小时从论坛图片到私有仓库
三名安全研究员把内存破坏漏洞交给 Claude Opus 4.8,在关闭系统内存随机化的前提下才勉强跑通;当晚 Anthropic 发布 Opus 5,第二天早上新模型约三小时就写出了可用的 ARM64 漏洞利用。不到 72 小时,他们从 OpenAI 论坛的一张 HEIC 图片一路走到了公司私有 monorepo。
本文编译自 Claude couldn’t hack OpenAI. Then Anthropic shipped Opus 5.,版权归原作者所有。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

推理成本持续走低,8 月每 token 价格再降 23.2%。Zed 用线程、OpenRouter 用区域路由、Anthropic 用统一界面,都在争夺执行框架这一层。Real-SWE 基准测试显示,最好的配置成功率也只有 38.8%,没有模型能突破 40%。

深度The New Stack·9月19日·6 分钟

OpenAI 前研究员、RLHF 发明者 Diogo Almeida 创立 TypeSafe AI,推出非大语言模型 Jev。它只输出校准后的概率而非文本,因此成本极低、速度极快、且不会幻觉。开发者已将其用于安全分类、邮件分类和模型路由等场景,还有人用它来监督 LLM Agent 的行为。

深度·9月18日·5 分钟

评论