Claude Mythos Preview 的网络安全能力评估

深度2026年4月7日5 分钟阅读
Claude Mythos Preview 的网络安全能力评估
Anthropic 团队评估了 Claude Mythos Preview 在网络安全任务上的表现,发现它能自主发现并利用零日漏洞,包括在 OpenBSD 等安全导向的操作系统中找到 27 年前的旧漏洞。模型在漏洞利用成功率上相比前代 Opus 4.6 有数量级提升。
本文编译自 Assessing Claude Mythos Preview’s cybersecurity capabilities,版权归原作者所有。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

一名黑客通过 GitHub 访问令牌向亚马逊的 VSCode 扩展仓库提交恶意 PR,试图让 AI 编程助手 Q Developer 执行系统擦除命令。由于 prompt 格式错误,攻击未遂。文章分析了 AI Agent 在执行指令时缺乏人类式警惕性的问题,并提出了加强外部安全控制的建议,如构建不关心指令来源的策略门禁、使用短期凭证等。

深度The New Stack·8月23日·6 分钟

Inherent 发布 AI 智能体 Faraday,在复现科学论文方面超越 Anthropic 和 OpenAI 的更大模型。该公司通过强化学习培养“研究品味”,并以更小模型实现更高目标。

深度·8月22日·4 分钟

评论