资讯

RTX 50用户白高兴!大神强上DLSS 5 NVFP4:性能只提升1%

驱动之家·2026/9/11 01:47:00🔗 原文

📋总体概括

社区开发者wilsjo2通过OptiScaler-DLSSNR-PreSR-Multipass项目0.7.1版本,将英伟达DLSS 5神经渲染模型从纯FP8迁移至混合FP8/NVFP4格式,并成功在RTX 50系列GPU上运行。RTX 50的第五代Tensor Core本原生支持NVFP4加速,理论上应显著提速,但实测神经渲染通道耗时仅缩短约1%至2%。《博德之门3》120秒测试中,混合模式55.16 FPS,纯FP8为54.57 FPS,差距不到1.5%,且开发者警告该差异未必稳定复现,仅将其设为推荐而非强推选项。

关键信息

  • 开发者wilsjo2借助OptiScaler项目0.7.1版本,将DLSS 5神经渲染模型迁移至混合FP8/NVFP4格式并在RTX 50上跑通。
  • 实测神经渲染通道耗时仅缩短约1%至2%,开发者本人称Blackwell上的提升「非常微小」。
  • 《博德之门3》120秒测试:混合NVFP4模式55.16 FPS,纯FP8为54.57 FPS,差距不足1.5%。
  • 开发者警告该微小差异尚未证实可稳定复现,仅在0.7.2版将NVFP4设为Blackwell的推荐选项。
  • 1%至2%仅指神经渲染通道耗时缩短,并非游戏整体帧率提升,实际体感收益更小。

🔥犀利点评

这是典型的「理论很性感,现实很骨感」。英伟达宣传NVFP4时把账算得漂亮,但真正跑起来,Tensor Core的峰值算力优势被模型结构、数据搬运和量化精度损失吃了个干净,只剩不到1.5%的噪音级差异。侧面说明:硬件参数表上的推理倍数,落地到实际工作负载往往缩水到可以忽略。对玩家而言,与其折腾这些社区魔改,不如等官方真正为NVFP4重写的模型——但愿那天不会太久。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文