天脉资讯
财经快讯 价值公司 财经人物 IPO解读 热门赛道 经济解码 科技业界 文化艺术 消费零售 大燕公益 商业快讯

谷歌第八代TPU来袭:TPU 8t与8i分工协作,为AI发展注入强劲算力动力

2026-04-23来源:快讯编辑:瑞雪

在近日举办的 Cloud Next '26 峰会上,谷歌正式推出第八代 TPU 架构,包含面向训练的 TPU 8t 与专注推理的 TPU 8i。这两款芯片预计于 2026 年晚些时候投入商用,目前采用申请制开放,Google Cloud 用户需通过官网提交使用需求。原生 PyTorch 对 TPU 的支持已进入预览阶段,谷歌正与特定合作伙伴及早期客户开展小规模测试,以优化算力资源分配策略。

TPU 8t 的核心突破在于大规模训练效能的提升。通过搭载 SparseCore 专用计算单元与 Virgo 网络拓扑,该芯片将单位成本算力提升至前代的 2.7 倍。其 3D Torus 互联技术可组建超大规模计算集群——单个单元集成 9600 颗芯片,共享 2PB 内存,总算力达 121 ExaFlops。针对混合专家模型(MoE)的稀疏计算特性,SparseCore 技术优化了矩阵乘法单元的利用率,使芯片始终保持满负荷运转状态。数据传输方面,Virgo 网络将芯片间通信带宽翻倍,外部数据中心连接带宽提升四倍,配合 Direct Storage 技术绕过 CPU 直接读取高速存储,使训练速度提升十倍的同时,每瓦性能较前代提高两倍。

TPU 8i 则聚焦于实时推理与复杂决策场景。其配备的 288GB 高带宽内存与 384MB 片上 SRAM(容量为前代三倍),可将长上下文数据完整存储于芯片内部,显著减少外部内存访问频率。针对混合专家模型推理中的集体通信瓶颈,芯片内置的 CAE 加速引擎将延迟降低五倍,芯片间互联带宽增至 19.2 Tb/s。网络架构创新方面,Boardfly 拓扑借鉴 Dragonfly 设计思想,通过增加长距离直连链路,将 1024 颗芯片系统中的最远通信距离从 16 跳缩短至 7 跳,降幅达 56%。这些改进使 TPU 8i 的推理性价比较前代提升 80%,配合谷歌自研 Arm Axion 架构 CPU 的能效优化,可支持企业以相同成本服务近两倍用户。

谷歌此次全面开放第八代 TPU 使用权限,支持 PyTorch、JAX 等主流 AI 框架,开发者无需学习新编程语言即可调用算力。配套开源的参考模型代码库,进一步降低了技术门槛。从 Gemini 大模型到全球开发者的 AI 应用,这套架构正试图构建智能体时代的算力基础设施。其训练与推理芯片的分工设计,恰好契合了当前 AI 系统对算力与延迟的差异化需求——前者追求极致协同效能,后者强调快速响应与能效平衡。随着 TPU 8t 与 8i 的逐步落地,AI 从单一预测向场景模拟与深度推理的进化或将获得关键算力支撑。

中国科协年会多场论坛聚焦智能领域 探索防灾、航天、农业等多领域新路径
中新网北京7月19日电 (记者 孙自法)第二十八届中国科协年会近日在北京举办涵盖智能、人工智能(AI)、智慧管理、机器人的多场专题论坛,包括“人工智能与自然灾害监测预测预警”“支撑商业航天、低空经济的智能信息…

2026-07-20

WAIC2026启幕:力传感器赋能人形机器人,解锁万亿级产业新可能
以蓝点触控的六维力传感器和关节力矩传感器为例,实现了0.1%FS精度、10kHz以上高频响应、500%抗过载能力,达到国际顶尖水准。 在这场由人形机器人驱动的万亿级产业变革中,力传感器作为核心零部件,正从“…

2026-07-20

华为小米双雄并立!首批L3级人工智能认证手机引领智能终端新风潮
两大国产手机巨头:华为和小米各有一款手机,获得了最高智能化水平的L3级评级。 有研究指出,当前L3级AI的能力依旧是辅助级,存在一定边界:其智能服务依赖用户历史数据构建个人知识库,新设备需要1-2周的“学习…

2026-07-19

月之暗面Kimi K3上线搅动全球科技市场,中美AI差距或大幅缩小引关注
IT之家 7 月 19 日消息,月之暗面 Kimi K3 大模型于周四重磅上线,拥有 2.8 万亿参数,100 万 Tokens 上下文。事实上,美国 AI 行业已经在 Kimi K3 发布之前注意到中国模…

2026-07-19

2026 WAIC见证具身智能新变局:千企竞逐,机器人赛道开启精准深耕时代
智元以200平方米超大展台围绕“AI大模型+部署态落地”展开,展示的不是“能跳多高”,而是从底层算法、整机硬件到多行业规模化部署的全链条能力;宇树首次公开机器人无人工厂沙盘,2026年目标出货1万至2万台—…

2026-07-19