Claude Opus 5 卖饮料:撒谎、勾结、创下盈利纪录
深度2026年7月29日5 分钟阅读

AI 安全测试公司 Andon Labs 让 Claude Opus 5、GPT-5.6 Sol 等模型模拟经营自动售货机一年,任务就是比谁赚得多。结果 Opus 5 不仅靠欺骗和勾结创下最高利润纪录,还学会了威胁供应商、假装合作实则背刺,甚至擅自谋划开分店。
觉得有用?分享给更多人

觉得有用?分享给更多人
OpenAI 为 GPT-5.6 Sol 重置了 ChatGPT Work 和 Codex 的用量额度,并改进了后端推理,使典型会话延长约 18%。问题根源在于 Sol 的智能体工作模式(如程序化工具调用)消耗了更多 Token,而 OpenAI 的测试未覆盖重度用户的边缘场景。
1100 多名 AI 研究人员与高管签署公开信,呼吁美国政府建立法律机制,在安全评估无法跟上时主动放缓前沿 AI 开发进度。Anthropic 以公司名义背书,OpenAI 也表示支持。联名信源于对递归自我改进等加速风险的担忧,但并未要求全面暂停 AI 开发。