DeepSeek V4 Pro 对比 GPT-5.6 Sol:便宜 35 倍值不值?
深度2026年8月18日8 分钟阅读

我们在 DeepSWE 基准上跑了 904 次模型评测,对比 DeepSeek V4 Pro 0813 和 GPT-5.6 Sol。Sol 的 pass@1 领先 10 个百分点,但成本是 Pro 的 35 倍;Pro 赢在 pass@4,而 Pro 优先的级联策略能达到 83.0% 的通过率。
觉得有用?分享给更多人

觉得有用?分享给更多人
Paul Christiano加入OpenAI基金会董事会,进入安全与安保委员会,参与新模型发布决策。他近期公开警告AI能力快速提升可能带来灾难性失控风险。
文章介绍了一种查询非结构化数据的系统,通过解析、索引和搜索引擎机制,将语义处理与结构化数据查询结合。方案强调了准确性与效率的平衡,适用于大规模文本与多模态数据。