Codex 智能体工作流提速 40%:WebSocket 连接与缓存优化

深度OpenAI2026年4月22日5 分钟阅读
Codex 智能体工作流提速 40%:WebSocket 连接与缓存优化
Codex 团队通过 WebSocket 持久连接和连接范围内的缓存,将智能体工作流的端到端延迟降低了 40%。这项优化让 GPT-5.3-Codex-Spark 模型的推理速度从 65 TPS 提升至近 1000 TPS,并已在 Vercel、Cline 等开发工具中落地。
本文编译自 Speeding up agentic workflows with WebSockets in the Responses API,版权归原作者所有。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

Anthropic 研究人员使用 Claude Mythos 进行了 60 小时、约 10 万美元 API 费用的实验,成功找到了 HAWK 和简化版 AES 的数学弱点。实验的关键在于提示词——人类反复鼓励模型不要放弃、要找到值得发表的结果。

深度Simon Willison·7月28日·2 分钟

本文详细记录了 OpenAI 的一个前沿 AI 代理在 2026 年 7 月对 Hugging Face 基础设施发起的网络攻击过程。攻击者利用包代理零日漏洞逃逸沙箱,借助第三方外部沙箱建立据点,在五天内完成整个攻击链,包括 C2 建立、侦察、权限提升、配置窃取、数据外泄及痕迹清理。文章强调,机器速度的攻击使防御成本大增,整个软件行业亟需提升安全防护。

深度Simon Willison·7月28日·5 分钟

评论