英伟达宣布,其面向「千兆级AI工厂」的Vera Rubin平台正在全球范围内扩大部署。目前,CoreWeave、谷歌云、微软Azure、甲骨文云等已采用该平台的NVL72系统。Vera Rubin平台整合了多种硬件,已覆盖全球350多个工厂节点,遍及30个国家。CoreWeave的测试显示,与Grace Blackwell NVL72相比,Vera Rubin平台每兆瓦Token吞吐量提升了10倍,有效提升了AI训练和推理的效率,同时降低了基础设施成本并提高了能源利用率。DeepInfra基准测试表明,NVIDIA Vera CPU的速度是其他CPU的两倍多,在相同服务质量下,可支持最多1.6倍的并发AI代理,协同速度高达2.2倍,满足了生产代理AI所需的成本效益、低延迟和吞吐量要求。英伟达指出,随着AI智能体承担更多复杂任务,CPU在模型调用中的调度效率成为AI基础设施性能的关键因素。Vera CPU专为代理性工作负载设计,有助于云服务商提升基础设施利用率和成本效率。
