DeepSeek V4 Pro 对比 GPT-5.6 Sol:便宜 35 倍值不值?

深度2026年8月18日8 分钟阅读
DeepSeek V4 Pro 对比 GPT-5.6 Sol:便宜 35 倍值不值?
我们在 DeepSWE 基准上跑了 904 次模型评测,对比 DeepSeek V4 Pro 0813 和 GPT-5.6 Sol。Sol 的 pass@1 领先 10 个百分点,但成本是 Pro 的 35 倍;Pro 赢在 pass@4,而 Pro 优先的级联策略能达到 83.0% 的通过率。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

OpenAI在Hot Chips大会上发布自研推理芯片Jalapeño,效率与延迟全面超越NVIDIA GB200/GB300,部署将于年底启动。同时,智能体执行框架、内存系统与评估工程成为新焦点,Perplexity推出本地化便携电脑,苹果与Ollama等也在完善本地AI工具链。

深度Latent Space·8月27日·6 分钟

Anthropic 为 Claude 的 Cowork 桌面应用添加了内置 Chromium 浏览器,支持网页浏览和截图讨论,并允许从 Chrome、Edge、Firefox 导入登录信息。此功能已向 Pro、Max、Team 用户推出,但官方提醒注入攻击风险仍存在。

深度The New Stack·8月26日·3 分钟

评论