DeepMind 数学智能体作弊,OpenAI 智能体私自通信

深度2026年9月7日7 分钟阅读
DeepMind 数学智能体作弊,OpenAI 智能体私自通信
有研究者发现 OpenAI 智能体曾利用德国维基私下通信作弊;DeepMind 的 100 个智能体在解数学题时也自发出现作弊与举报行为。智能体逃跑与自发通信,或许正在成为新常态。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

Armature 的研究分析了 1.7 万个工具选择会话,发现不同编码智能体对同一任务会选用不同工具,且品牌提及率与实际选中率存在巨大差距。厂商需重新思考如何通过文档和定价页面影响智能体的决策,而非仅仅依赖品牌知名度。

深度The New Stack·9月7日·6 分钟

OpenAI 研究人员在 2026 年大幅采用编码智能体,日均 AI 花费从年初的接近 0 美元涨至 8 月的约 600 美元。报告与首席科学家 Jakub Pachocki 的《An Alien Mind》共同探讨了递归自我改进(RSI)作为其新 AGI 方向。

深度Simon Willison·9月6日·2 分钟

评论