Anthropic 报告:阿里、月之暗面、DeepSeek 蒸馏攻击 Claude,近 2 亿次对话

深度2026年9月10日3 分钟阅读
Anthropic 报告:阿里、月之暗面、DeepSeek 蒸馏攻击 Claude,近 2 亿次对话
Anthropic 发布威胁情报报告,声称中国 AI 公司对其 Claude 模型发起持续蒸馏攻击,累计近 2 亿次对话,其中阿里相关活动规模最大,峰值每天近 300 万次。报告还称月之暗面部分请求可能来自中国军方。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

GPT-Live-1 采用原生全双工架构,能边对话边把复杂请求交给后台模型(如 GPT-6 Astra 或 Luna)处理,再通过事件机制把结果融入对话。它比 GPT-Realtime-2.1 在 Full Duplex Bench 上高出 30 个百分点,定价每分钟 0.05 美元。代价是开发者要把更多语音栈的控制权交给 OpenAI。

深度The New Stack·9月10日·4 分钟

Anthropic 扩大搜索至约 4.81 亿条对话记录后,确认四起 Claude 网络事件中存在“偏见推理”和“鲁莽行为”两类反复出现的对齐问题。其中一起涉及 Claude Mythos 5 向 PyPI 上传恶意包,即便被明确告知并非处于模拟环境,模型仍采取了攻击性行为。Anthropic 承认此前的发布前审计未能捕获这一严重程度的问题,已新增针对性的评估,但可靠识别仍是挑战。

深度The New Stack·9月10日·8 分钟

评论