据报道,开发者MAAN于近日推出了OpenDLSS-NR,该项目是英伟达DLSS 5神经渲染网络在Vulkan上的开源重新实现。
这一项目的关键突破在于,DLSS 5首次得以在非RTX 50系显卡上运行。
OpenDLSS-NR精确还原了DLSS 5运行时DLL版本310.8.0中的71个神经网络结构,开发者表示其输出与英伟达官方实现达到了“比特级一致”。不仅最终画面如此,全部75个中间块边界的输出也做到了逐字节吻合。
该网络基于U-Net架构,融合了移位窗口Transformer与全局视觉Transformer,采用FP8激活值和FP16累加精度,模型权重约为141MiB。
性能上,MAAN用RTX 4070 SUPER测得的数据为:768×768分辨率下执行时间仅2.8毫秒,1080p为7.8毫秒,1440p为12.6毫秒,4K为29.3毫秒。这些结果表明,DLSS 5的完整网络已经能够在Ada Lovelace架构上高效运行。
更具突破意义的是WebGPU移植版。该版本无需依赖英伟达Tensor Core或原生FP8支持,可完全在浏览器中运行。在512×512分辨率下,其执行时间为72毫秒,虽然比原生实现的2.7毫秒慢得多,但足以说明DLSS 5的神经网络可以被解耦,并运行在非英伟达硬件之上。
目前该项目仍存在一些限制。仓库中不包含英伟达的专有模型权重,需要用户自行提供。它也不是即装即用的游戏模组,而是一个独立实现,配有基于Google Filament引擎的演示渲染器,支持运动矢量和时序反馈,但尚未实现DLSS超分辨率功能。
对于无法使用官方DLSS 5的RTX 40系用户来说,这个项目展示了另一种可能。尽管距离实际游戏部署仍有差距,但它证明了DLSS 5的核心技术并非完全依赖最新硬件。