英伟达DLSS 5神经渲染技术因核心DLL文件泄露,在科技圈引发广泛关注,全球开发者纷纷展开技术探索。有开发团队尝试将FP8与NVFP4低精度格式结合,并应用于DLSS 5模型,在RTX 50系列显卡上进行测试。尽管利用了Blackwell架构Tensor Core对NVFP4的原生支持,但性能提升并不显著,4K分辨率下神经渲染阶段耗时仅优化1%-2%,在《博德之门3》的测试中,帧率仅提升1.08%。此外,当前方案还无法实现全流程NVFP4计算覆盖。OptiScaler-DLSSNR-PreSR-Multipass项目的0.7.2版本对混合精度路径进行了优化,将NVFP4列为Blackwell架构显卡的推荐配置,但对游戏整体性能的影响仍然有限。行业专家指出,DLSS 5的优化面临模型架构、量化策略、驱动适配等多重挑战。尽管英伟达官方宣称其运行速度较首次演示提升了5倍,并支持RTX 40系列显卡,但社区测试显示,现有优化方案尚未实现革命性突破。目前,全球开发者仍在探索模型压缩、动态精度调整等更高效的优化方案,以推动实时渲染领域向更高效的方向发展。
