Appearance
Google发布TPU 8t/8i:为Agent时代打造的双芯片架构
📰 概要
2026年4月22日,Google在Cloud Next 2026大会上发布两款全新TPU芯片:TPU 8t(训练优化)和TPU 8i(推理优化)。这是Google首次将训练和推理芯片分拆,专门为"Agent时代"设计——AI Agent需要快速推理、多步规划,TPU 8i正是为此而生。
Google表示,这两款芯片配合其全栈基础设施(网络、数据中心、能源优化),将把"响应式Agent AI"带给大众。
🔍 解读
为什么要分拆训练和推理?因为Agent的工作负载和传统大模型不同。传统大模型"训练一次、推理无数次",Agent是"持续推理、频繁规划"。TPU 8i专为低延迟推理设计,能让Agent在毫秒级完成多步推理,用户体验更流畅。
TPU 8t则针对超大规模模型训练优化——单一内存池可以承载最复杂的模型,不再需要拆分到多个芯片上。这对万亿参数模型的训练至关重要。
Google的芯片战略正在从"追赶英伟达"转向"差异化竞争"。英伟达GPU是通用算力,TPU是AI专用算力。在Agent场景下,专用芯片的效率优势会更明显。
💎 深挖
从产业格局看,Google此举是"垂直整合"的深化。芯片(TPU)+框架(JAX)+模型(Gemini)+应用(Workspace),Google正在构建从硬件到软件的完整AI栈。这和苹果的"芯片+系统+应用"策略类似,只是Google的目标是企业级AI市场。
对用户来说,TPU 8i意味着什么?如果你用的是Google Cloud上的AI服务(如Gemini API),推理速度会更快、成本会更低。Google可以把TPU的效率优势转化为价格优势。
对竞争对手来说,Google的芯片能力正在成为护城河。OpenAI没有自己的芯片,微软的Maia芯片还在早期,Google在AI芯片上的投入已经持续了近十年。
什么情况建议关注?如果你在评估云服务商的AI能力,TPU 8t/8i是Google Cloud的差异化卖点,值得纳入对比。什么情况暂不急?如果你用的是AWS或Azure,这对你影响不大,但可以期待各家的芯片竞赛带来整体价格下降。
