AI工厂的“动力心脏”迎来换代
在AI算力需求持续爆炸性增长的背景下,基础设施的能效比已成为行业竞争的核心。近日,英伟达向外界公布了其面向下一代“千兆级AI工厂”的Vera Rubin平台的最新进展。这一平台并非简单的硬件迭代,而是一次从计算核心到网络互联的系统级重构。
实测数据亮眼:能效比实现数量级飞跃
最引人注目的消息来自云服务提供商CoreWeave的早期测试。数据显示,采用Vera Rubin架构的旗舰级NVL72系统,与基于Grace Blackwell的上一代NVL72系统相比,在消耗相同单位电力的条件下,其Token处理吞吐量提升了惊人的10倍。
这个数字意味着,对于运行大规模AI训练和推理任务的企业来说,在电力成本不变的前提下,可获得近乎一个数量级的算力提升。这直接回应了当前AI发展面临的最大挑战之一:日益高昂的运营成本和能源消耗。
系统级创新:不止是更强的GPU
Vera Rubin平台的性能飞跃源于其全栈优化。它并非单一芯片的升级,而是整合了一系列专为高效AI工作负载设计的组件:
- 新一代计算核心: 融合了专为AI优化的Vera CPU与Rubin GPU。
- 极致互联带宽: 采用了第六代NVLink技术,确保芯片间数据畅通无阻。
- 智能网络与存储: 搭载了最新的ConnectX-9 SuperNIC网络适配器、BlueField-4 DPU以及Spectrum-6交换机,大幅降低了数据在系统内流动的延迟与开销。
这种深度集成的设计思路,旨在将整个计算集群作为一个协调一致的高效整体来运作,而不仅仅是堆砌强大的个体。
全球布局加速,生态已然成型
市场对新平台的接纳速度超出预期。除了CoreWeave,包括谷歌云、微软Azure和甲骨文云在内的多家头部云厂商也已开始部署Vera Rubin系统。根据英伟达公布的信息,该平台目前已在全球30多个国家落地,覆盖了超过350个工厂节点。
广泛的早期采用表明,行业对于能够同时提升性能、降低总拥有成本(TCO)的解决方案有着迫切需求。Vera Rubin平台的快速铺开,不仅巩固了英伟达在AI硬件领域的领先地位,也为下一代AI应用的开发铺平了道路,让更复杂、更庞大的模型训练变得在经济上更加可行。