Google 为智能体时代拆分 TPU 产品线

深度The New Stack2026年4月22日5 分钟阅读
Google 为智能体时代拆分 TPU 产品线
Google 在 Cloud Next 大会上推出两款专用芯片:TPU 8t 专为万亿参数训练设计,TPU 8i 则让长上下文推理模型的 KV 缓存完全驻留芯片。Google 认为,智能体工作负载已让单一加速器无法兼顾训练与推理最优。
本文编译自 Google splits its TPU line in two for the agentic era,版权归原作者所有。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

开发者用普通用户的预算和条件复现 Terminal-Bench-Science 的五个任务,对比 Claude Fable 5 与 Fable 5.1。结果:Fable 5.1 解出 1/5,Fable 5 解出 0/5,远低于 Anthropic 公布的 52.6% 和 24.7%。最大差异在成本——Fable 5.1 总计花费 40.75 美元,Fable 5 花费 53.59 美元且四次触顶。五个任务的样本太小,无法证实或推翻“翻倍”说法。

深度The New Stack·9月10日·7 分钟

Paul Christiano加入OpenAI基金会董事会,进入安全与安保委员会,参与新模型发布决策。他近期公开警告AI能力快速提升可能带来灾难性失控风险。

深度·9月9日·3 分钟

评论