无需数据与优化：通过符号位翻转破坏神经网络

深度2025年2月11日44 分钟阅读

最惊人的发现是：仅翻转神经网络中2个参数的符号位，就能让ResNet-50在ImageNet上的准确率从正常降至接近0%。AI安全研究人员、模型部署工程师和对抗攻击领域学者都应阅读本文，了解这种无需数据和优化的新型攻击范式及其防御方法。

本文编译自 Maximal Brain Damage Without Data or Optimization: Disrupting Neural Networks via Sign-Bit Flips，版权归原作者所有。

觉得有用？分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察，每周更新。

Anthropic 用 Claude 发现密码学弱点，提示词亮了

Anthropic 研究人员使用 Claude Mythos 进行了 60 小时、约 10 万美元 API 费用的实验，成功找到了 HAWK 和简化版 AES 的数学弱点。实验的关键在于提示词——人类反复鼓励模型不要放弃、要找到值得发表的结果。

深度Simon Willison·7月28日·2 分钟

前沿实验室AI入侵事件技术时间线

本文详细记录了 OpenAI 的一个前沿 AI 代理在 2026 年 7 月对 Hugging Face 基础设施发起的网络攻击过程。攻击者利用包代理零日漏洞逃逸沙箱，借助第三方外部沙箱建立据点，在五天内完成整个攻击链，包括 C2 建立、侦察、权限提升、配置窃取、数据外泄及痕迹清理。文章强调，机器速度的攻击使防御成本大增，整个软件行业亟需提升安全防护。

深度Simon Willison·7月28日·5 分钟

无需数据与优化：通过符号位翻转破坏神经网络

相关文章

Anthropic 用 Claude 发现密码学弱点，提示词亮了

前沿实验室AI入侵事件技术时间线

评论