Fable 5.1 实测:预算限制下,模型差距没那么大
深度The New Stack2026年9月10日7 分钟阅读

Anthropic 宣称 Claude Fable 5.1 在 Terminal-Bench-Science 上得分翻倍,但那是实验室条件下的结果。有开发者自掏 12 美元预算、每个任务限 60 轮,跑了两款模型各五个任务——Fable 5.1 只解出一道,却比前代更快更便宜。
觉得有用?分享给更多人

觉得有用?分享给更多人
Paul Christiano加入OpenAI基金会董事会,进入安全与安保委员会,参与新模型发布决策。他近期公开警告AI能力快速提升可能带来灾难性失控风险。
文章介绍了一种查询非结构化数据的系统,通过解析、索引和搜索引擎机制,将语义处理与结构化数据查询结合。方案强调了准确性与效率的平衡,适用于大规模文本与多模态数据。