资讯

RTX 50用户白高兴!大神强上DLSS 5 NVFP4:性能只提升1%

驱动之家·2026/9/11 01:47:00🔗 原文

📋总体概括

社区开发者wilsjo2通过OptiScaler-DLSSNR-PreSR-Multipass项目v0.7.1,成功将英伟达DLSS 5神经渲染模型从纯FP8迁移至混合FP8/NVFP4格式,并在RTX 50系列GPU上跑通。尽管Blackwell的第五代Tensor Core原生支持NVFP4加速,实测却令人失望:完整神经渲染通道耗时仅缩短约1%至2%,一次120秒《博德之门3》测试中混合模式帧率55.16 FPS对比纯FP8的54.57 FPS,差距不足1.5%且开发者称尚无法稳定复现。这表明NVFP4在DLSS神经渲染场景的收益极为有限。

关键信息

  • 开发者wilsjo2通过OptiScaler-DLSSNR-PreSR-Multipass v0.7.1实现DLSS 5模型FP8/NVFP4混合迁移,RTX 50上运行成功
  • 完整神经渲染通道耗时仅缩短约1%至2%,且开发者将Blackwell上的提升形容为非常微小
  • 120秒《博德之门3》测试:混合模式55.16 FPS,纯FP8为54.57 FPS,差距不足1.5%
  • 开发者警告该微小差异尚无法稳定复现,并在v0.7.2中仍将NVFP4混合设为Blackwell推荐选项
  • 1%至2%仅指DLSS 5神经渲染通道耗时缩短,并非游戏整体帧率提升

🔥犀利点评

理论带宽和纸面算力堆得再漂亮,跑不进真实负载就是空谈。这次实验恰恰证明:NVFP4对DLSS这类小模型推理的意义被过度吹捧了——瓶颈根本不在数值精度,而在内存带宽、调度开销和模型结构本身。1%的收益连跑测试的误差都盖不住,英伟达把NVFP4当卖点宣传时,恐怕自己心里也没底。玩家与其期待 precision 换帧率,不如等架构层面的真升级。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文