
(图片来源:AMD)
7月AMD推出EPYC 'Venice' CPU后,于周五进一步阐释了其下一代服务器芯片的性能声明。核心声明内容未变,AMD仍表示,在SPEC CPU 2026的整数速率测试中,96核高频Venice芯片相较于英伟达的88核Vera,性能提升约20%。不过,AMD在一份新白皮书中对基准测试进行了更为详尽的说明。
(图片来源:Future)
AMD的白皮书针对不同基准测试列举了多种配置差异,尽管我们尽力指出这些差异,但无法掌握所有细节。特别是与Vera的对比,AMD混合了来自不同渠道的数据,且在某些情况下使用了不同主要版本的GNU编译器集合(GCC),这可能对性能产生重大影响,因此,对于这些数据,请审慎看待。
(图片来源:AMD)
首先来看SPEC CPU 2026的intrate测试结果,该测试关注总吞吐量。这些数据较早,于7月使用GCC 15.2收集。intrate测试在同一CPU上运行应用程序的多个副本,标准做法是每个线程运行一个副本。推测AMD也是如此操作,但白皮书未明确说明,即便在脚注中也未提及。
根据幻灯片显示,256核的9996芯片比Intel Xeon 6980P快2.37倍,比Vera快2.24倍。白皮书明确指出,神秘的9006 CPU为256核旗舰产品。或许最令人印象深刻的是AMD的代际对比。根据这些结果,9996芯片比上一代的192核EPYC 9965快约78%。
尽管高级别结果包含了来自英特尔和AWS的数据,但白皮书的大部分内容聚焦于Venice和Vera的对比。AMD在白皮书中详细剖析了SPEC CPU 2026 intrate的各个子测试,具体如下。
(图片来源:AMD)
自然,这些对比结果对AMD有利,尽管配置上存在一些差异。AMD测试的是降核版的EPYC 9996,从256核降至96核。AMD未提及功耗预算,但当初次分享SPEC数据时,96核型号的功耗与256核型号相同,均为600W,而AMD的96核高频Venice SKU最高功耗为500W。更关键的是编译器问题。AMD使用的是GCC 16.1,并将其结果与英伟达在Vera白皮书中分享的GCC 15.2结果进行对比。
Phoronix的Michael Larabel对GCC 15和16之间的差异进行了深入分析,简而言之,两者存在性能差异,且并不总是朝着有利的方向发展。GCC 16由于优化更佳,编译时间更长,因此在GCC和LLVM编译中的得分较低。然而,这会产生更快的二进制文件。具体快多少取决于标志、软件和一系列其他因素。无论如何,使用两个不同编译器版本进行对比并非最佳实践。
(图片来源:AMD)
提及Phoronix,AMD为该出版物的Vera初步控制测试提供了一些数据。上图展示的是Stream,这是衡量内存带宽的行业标准基准测试。同样,AMD使用的是降核版的9996,从256核降至96核,并为其提供600W的功耗预算。尽管如此,这一表现依然令人瞩目,因为在该出版物的原始Stream结果中,Vera曾以绝对优势碾压竞争对手。而在此,AMD领先约18%,单核性能领先约8%。
(图片来源:AMD)
除了与Vera的对比,AMD还展示了在云工作负载中的性能,包括数据库、Java和加密等方面。同样,代际对比依然突出,因为AMD上一代芯片在这些工作负载中已处于领先地位。AMD自行进行了这些测试,而非依赖第三方数据,不过Graviton5的结果来自AWS云实例。
(图片来源:AMD)
同样,在HPC工作负载中,AMD进一步扩大了对英特尔旗舰Granite Rapids-AP的优势。英特尔下一代数据中心CPU代号为Diamond Rapids,计划于明年发布。
(图片来源:AMD)
最后,我们来看看“智能体AI工作负载性能”,尽管上图中的名称有所暗示,但实际是使用了真实基准测试进行对比。从左到右,AMD依次使用了NGINX、TPCx-AI套件、FAISS、TPC-H和TPC-C,以及一个多角色智能体的重放。对于TPC-H和TPC-C,AMD表示其工作负载源自这些基准测试,因此这里的结果与已发布的结果不可直接对比。
尽管查看基准测试结果总是颇有趣味,但在服务器部署的背景下,这些结果的意义相对有限,至少在AMD所瞄准的规模上是如此。毕竟,峰值性能只是服务器部署的主要考量因素之一,而且即便如此,性能也会因所运行的软件及其构建方式而大相径庭。
尽管如此,Venice的表现依然令人印象深刻,或许在代际对比中比在任何竞争对比中更甚。希望这对AMD未来在消费级桌面上的Zen 6发布是个好兆头,但在得出任何结论之前,我们仍需等待红队(AMD)分享更多信息。
在Google新闻上关注Tom's Hardware,或将我们添加为优选来源,以便在我们的订阅源中获取最新新闻、分析和评测。
