资讯

RTX 50用户白高兴!大神强上DLSS 5 NVFP4:性能只提升1%

驱动之家·2026/9/11 01:47:00🔗 原文

📋总体概括

社区开发者wilsjo2通过OptiScaler-DLSSNR-PreSR-Multipass项目0.7.1版本,成功将英伟达DLSS 5神经渲染模型从纯FP8迁移至混合FP8/NVFP4格式,并在原生支持NVFP4加速的RTX 50系列GPU上跑通。但实测结果令人失望:神经渲染通道耗时仅缩短约1%至2%,与理论上的显著加速预期相去甚远。0.7.2版本中《博德之门3》120秒测试显示,混合模式55.16 FPS对纯FP8的54.57 FPS,差距不到1.5%,且开发者自己警告该差异未必能稳定复现。

关键信息

  • 开发者wilsjo2通过OptiScaler项目0.7.1版实现DLSS 5模型FP8至混合FP8/NVFP4迁移,在RTX 50上运行成功
  • 实测神经渲染通道耗时仅缩短1%至2%,远低于理论预期
  • 《博德之门3》120秒测试中混合模式55.16 FPS对纯FP8的54.57 FPS,差距不到1.5%
  • 开发者自评Blackwell上提升「非常微小」,并警告差异未必稳定可复现
  • 该提升仅限神经渲染通道耗时,不等于游戏整体帧率提升

🔥犀利点评

这是理想很丰满、现实很骨感的典型案例:Tensor Core纸面上原生支持NVFP4,社区大神真把它跑通了,结果换来1%的收益——工程上成功,商业上毫无意义。本质问题可能出在模型形状不匹配和精度瓶颈上,说明硬件规格与实际推理收益之间隔着整个软件生态。英伟达营销里的「原生加速」字样,消费者看看就好,别当真。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文