Goodfire 推出「由内而外」AI 监控器,成本仅十分之一

深度2026年10月8日4 分钟阅读
Goodfire 推出「由内而外」AI 监控器,成本仅十分之一
传统 AI 智能体监控靠另一个 AI 通读所有输出,一小时烧掉上千美元是常事。Goodfire 换了个思路:直接读取模型内部的神经元激活信号,只凭约 2% 的额外延迟,就能抓住 94% 的恶意行为,成本却只要 51 美元。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

作者把自己的 Azure 凭证交给编程 Agent,实测了鉴权、授权、权限范围和审计覆盖的真实状态。借来的凭证让审计日志只认人不认 Agent,还悄悄继承了人累积的组权限(而标准权限检查根本看不到这些)。即使换成配置规范的服务账号,问题依然存在:数据库无法区分调用者是谁。

深度The New Stack·10月8日·12 分钟

Anthropic 在 Opus 5.5 发布六天后推出 Sonnet 5.5,官方称其在 Terminal-Bench 4.0 上得分 70.6%,高于 Opus 5.5 的 66.4%,且输出速度快 30% 以上。作者通过三个测试任务各跑 5 次对比:Sonnet 5.5 在 15 次运行中全部通过,总花费 12.69 美元;Opus 5.5 通过 13 次,花费 22.07 美元。结论是 Sonnet 5.5 适合作为高难度编码的默认选择,但智能体循环仍应使用 Opus 5.5。

深度The New Stack·10月8日·8 分钟

评论