DiG-bench 评估 AI 创造力,Zuck 发文引质疑
深度2026年8月17日8 分钟阅读

新基准 DiG-bench 用 70 个文字游戏测试 AI 的发现与创造力,结果显示前沿模型仍难敌人类。Inherent 的 Faraday 模型在科研复现任务上超越 GPT-5.5,而扎克伯格的最新宣言却回避了超级智能可能带来的权力平衡问题。
觉得有用?分享给更多人

觉得有用?分享给更多人
Paul Christiano加入OpenAI基金会董事会,进入安全与安保委员会,参与新模型发布决策。他近期公开警告AI能力快速提升可能带来灾难性失控风险。
文章介绍了一种查询非结构化数据的系统,通过解析、索引和搜索引擎机制,将语义处理与结构化数据查询结合。方案强调了准确性与效率的平衡,适用于大规模文本与多模态数据。