天脉资讯
财经快讯 价值公司 财经人物 IPO解读 热门赛道 经济解码 科技业界 文化艺术 消费零售 大燕公益 商业快讯

英伟达Rubin GPU架构揭秘:3nm工艺加持,智能体AI性能飙升10倍

2026-07-23来源:快讯编辑:瑞雪

英伟达正式公布了其下一代GPU架构Rubin的详细信息,这款基于台积电3nm(N3P)工艺制造的芯片在性能和能效方面实现了重大突破。Rubin GPU通过双Die封装设计,集成多达3360亿个晶体管,较前代Blackwell GB300芯片增加62%,同时将智能体AI工作负载的单位能耗吞吐量提升至10倍。

架构设计上,Rubin采用双Die封装方案,每个Die集成4个图形处理集群(GPC),通过NVIDIA高带宽接口(NV-HBI)实现统一管理。全芯片共包含8个GPC,其中4个配备30个流式多处理器(SM),另4个配备26个SM,总计224个SM和896个Tensor Cores。每个Die还配置了两组去中心化L2缓存、Gigathread引擎、4个HBM通道(单通道4096位)及NVLink接口,形成高效计算单元。

在互联性能方面,Rubin支持多层级带宽配置:NVLink 6提供3600 GB/s的GPU间互联带宽,NVLink-C2C接口实现1800 GB/s的CPU至GPU通信带宽,PCIe Gen6 x16通道则提供256 GB/s的主机连接能力。这种设计使芯片在复杂计算场景中具备更强的数据吞吐能力。

内存系统是Rubin的核心升级点之一。该架构搭载8个12层堆叠的HBM4内存模块,总容量达288GB,单堆栈容量36GB,峰值带宽提升至22 TB/s,较Blackwell的8 TB/s提升1.8倍。这种配置不仅支持更大规模的模型训练,还能在生成式AI的逐令牌处理阶段保持模型权重与KV状态的高速传输,显著提升推理效率。

性能跃升得益于三大架构创新:增强型张量核心支持扩展精度计算,第三代Transformer引擎优化了注意力机制处理,全新HBM4内存子系统则突破了数据传输瓶颈。这些改进使Rubin在处理智能体AI等复杂任务时,既能保持低功耗运行,又能实现指数级性能提升,为大规模AI部署提供了硬件基础。

从分散到聚合:字节跳动如何以“豆包工作”重构AI办公新生态?
字节之所以选择豆包作为入口,在于它早已占据 C 端用户心智,过去两年,豆包几乎成为了大众语境里 AI助手的代名词,能够触达最广阔的用户群,也沉淀了基础的用户行为,包括资料搜索、内容生成、文件处理等。 说到…

2026-08-29

OpenAI申请彻底驳回苹果窃密诉讼 法院10月1日将召开听证会审理
IT之家 8 月 28 日消息,据科技媒体 MacObserver 今天报道,OpenAI 近日向法院提交申请,要求彻底驳回苹果的窃密诉讼。同时 OpenAI 法律团队认为,苹果实际上是要求法官猜测事情究竟…

2026-08-29

OpenAI测试Codex“持久模式”:AI可连续工作25小时 自主推进任务但风险待解
【环球网科技综合报道】8月28日消息,据外媒WIRED报道,通过查阅产品代码发现,OpenAI正在为代码智能体Codex测试“持久模式”新特性,这款AI可以持续自主处理任务,直至用户手动将其 “休眠”,标志…

2026-08-28

OpenAI自研芯片Jalapeño:AI设计新速度,挑战英伟达市场地位
更值得关注的是,这一成绩是在Jalapeño尚未启用投机解码、未做预填充与解码分离部署等优化手段的情况下取得的,而参与对比的其他芯片均已开启各自最优配置。 外界普遍预设Jalapeño是一颗专为OpenAI…

2026-08-28

天津机器人“天团”崛起:从产线到生活,智造硬实力引领全球新赛道
深之蓝海洋科技股份有限公司的水下助推机器人拿下全球近60%市场份额;天津瀚海蓝帆海洋科技有限公司新款船舶清洗机器人进入新加坡市场……从核心零部件到整机制造,从系统集成到场景应用,一条完整的机器人产业链正在这里…

2026-08-28