Codex 智能体工作流提速 40%:WebSocket 连接与缓存优化

深度OpenAI2026年4月22日5 分钟阅读
Codex 智能体工作流提速 40%:WebSocket 连接与缓存优化
Codex 团队通过 WebSocket 持久连接和连接范围内的缓存,将智能体工作流的端到端延迟降低了 40%。这项优化让 GPT-5.3-Codex-Spark 模型的推理速度从 65 TPS 提升至近 1000 TPS,并已在 Vercel、Cline 等开发工具中落地。
本文编译自 Speeding up agentic workflows with WebSockets in the Responses API,版权归原作者所有。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

谷歌发布了 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型,主打更高效率、更低成本和专门化场景(如网络安全)。但旗舰模型 Gemini 3.5 Pro 迟迟未更新,而竞争对手 OpenAI 和 Anthropic 已推出多款新模型,加剧了市场压力。

深度·7月21日·3 分钟

Google 推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款模型。3.6 Flash 在多项基准测试中显著优于 3.5 Flash,且成本更低;3.5 Flash-Lite 速度最快、性价比最高;3.5 Flash Cyber 专用于网络安全,仅限有限试点。此外,3.5 Pro 正在测试中,Gemini 4 预训练已启动。

深度·7月21日·5 分钟

评论