英伟达(NVDA)在CES 2026上正式发布下一代人工智能(AI)芯片组"鲁宾(Rubin)",备受业界期待。鲁宾的推理性能较前代产品布莱克威尔(Blackwell)提升了5倍,拥有总计3360亿个晶体管和50 Petaflops规模的性能,为AI超级计算树立了新标杆。
鲁宾架构采用了全新的Transformer引擎和基于硬件的自适应压缩功能,以最大化能效和计算处理能力。其特点在于通过该功能,在执行AI模型时减少数据量,从而提高处理速度。其训练性能也达到35 Petaflops,较布莱克威尔提升了2.5倍以上。英伟达CEO黄仁勋强调:"鲁宾是AI需求激增时期优化的产品,得益于六种新型芯片紧密连接的设计,它将开启通往AI计算新前沿的飞跃。"
英伟达在本届CES上,与鲁宾一同展示了高性能AI服务器整合解决方案"Vera Rubin NVL72"。该系统由72个鲁宾GPU和36个基于88核心的新型CPU"Vera"构成,总计搭载了220万亿个晶体管。该系统的带宽达到每秒260 Terabits,超越了整个互联网的水平,并通过实时硬件状态检查和容错功能,进一步增强了运行稳定性。
系统还搭载了负责数据传输的NVLink 6交换机、用于以太网连接的Spectrum-6,以及减轻服务器CPU负载的超级网卡"ConnectX-9"等三种高性能网络芯片,从而改善了GPU间的数据共享和AI计算效率。特别是ConnectX-9专为处理网络计算而设计,替代了传统服务器CPU的角色,从而能为AI工作负载分配更多资源。
在存储方面,新增了基于新型数据处理单元(DPU)"BlueField-4"的"推理上下文内存存储平台",有助于最小化大型语言模型(LLM)的重复工作并提高计算效率。它通过键值缓存方式复用相同计算结果,从而最大化AI硬件效率。
基于鲁宾的系统预计将从下半年开始陆续出货,除了搭载72个芯片的NVL72外,还将一同发布由8个鲁宾芯片组成的小型服务器"DGX Rubin NVL8"。这两款系统计划用作英伟达下一代AI集群设计"DGX Superpod"的标准模型。同时,也将提供用于AI基础设施整合运营的任务控制平台。
在英伟达旨在同时解决AI计算性能提升和基础设施整合这两大挑战的战略日益清晰之际,鲁宾系列似乎将成为2026年AI硬件市场的核心关键词。


