DLSS 5还没发布就被破解,RTX 30强行上车:138帧只剩4帧

老黄估计也没想到,DLSS 5 的第一次大规模民间测试,会来得这么突然。

今年 3 月,NVIDIA 才刚刚发布 DLSS 5,并宣布将在今年秋季正式推出。
结果 NVIDIA 这边还没发货,玩家已经提前拆封了…
是这样:
前两天,玩家 Renan Maniero 在《NBA 2K27》抢先服游戏目录里发现了一个以前没见过的文件:「nvngx_dlssnr.dll
但从名字基本就能判断这东西正是 DLSS Neural Rendering,也就是 DLSS 5 神经渲染的运行库。
文件版本为 310.8.0.0,体积达到了 158MB,差不多是目前一些 DLSS 运行库的三倍左右。
不过最开始,大伙儿也没太在意,毕竟《NBA 2K27》游戏里压根没有开放 DLSS 5 选项,单独把 DLL 拿出来,也不代表扔进其他游戏就能直接用。
结果不到一天,社区大能就把脸打了回来:
利用 RenoDX、ReShade 等工具,将这套神经渲染模型搬到了《控制》里,而且已经能够作用于人物模型,可以对风格、效果强度、色调和画面结构强度等参数进行调整。
还真给它跑起来了。
也就是说,NVIDIA 计划秋季才正式上线的 DLSS 5,就这么提前几个月被民间摸到了门路。
不过第一批测试还有个限制:泄露出来的这个版本,只能在 RTX 50 系显卡上正常运行。
其实也不太意外,毕竟目前泄露出来的 DLL 中包含针对 Blackwell 架构编译的 CUDA binary,前代显卡无法直接执行。
而且就算是在 RTX 50 系上,这东西性能开销也挺大的。
使用 RTX 5070 Ti 测试《控制》,4K 下开启 DLSS 5 后,帧率从约 71 帧 掉到了 35 帧。
几乎直接腰斩。
需要注意的是,这次测试没有公布完整画质设置和内部渲染分辨率,所以只能作为早期性能参考,不能代表正式版表现。
正常来说,故事讲到这差不多也该结束了。
毕竟新技术配新显卡,大家都习惯了老黄这种做法了,就看正式版表现如何了
但极客显然不这么想。
50 系能跑,那 40 系怎么能缺席呢?
没过多久,网友「Uncle Burrito就把 RTX 40 系的 DLL 端上来了。
简单来说,他检查了其中调用的 CUDA binary,把 Ada Lovelace 无法兼容的部分替换成重新编译的版本。
然后 RTX 4080 Super 也成功把 DLSS 5 跑了起来。
到了这里,事情发展就开始离谱起来了。
因为 RTX 40 系都上车了,没理由让 RTX 30 系落下。于是 RenoDX 社区又继续往 30 系上折腾。
最终,RTX 3050、3060 Ti、3070、3080 等一众老卡,还真陆续出现了成功运行 DLSS 5 的案例。
只不过虽然能跑,但也仅限于「能跑」。
最有节目效果的,是玩家 Flourek 用 RTX 3080 测试《深岩银河》。
不开 DLSS 5 时:138 帧。打开之后:4 帧。
一刀直接砍掉了约 97%。
延迟也从原来的约 7~8ms,一路暴涨到 260ms 左右。
RTX 3080 好歹还能看到 PPT,再往下走就更抽象了。
笔记本 RTX 3070 在《天国:拯救2》中使用实验性的 Ampere FP16 版本。
开启前游戏大约还能跑 60 帧。开启 DLSS 5 后,渲染延迟直接从约 29ms 暴涨到 3326ms。
也就是一帧等三秒多。
与此同时,RTX 3050、RTX 3060 Ti 用户测试《控制》《FiveM》《天国:拯救2》等游戏时,也普遍出现了个位帧数甚至 1 帧的结果。
完全是真·PPT。
折腾党当然也不会就此罢休。
继续调整之后,一些高端 30 系显卡还真把帧数救回来了一点。
目前公开案例里,RTX 3080 Ti 跑《GTA V》能做到约 20~30 帧;
RTX 3080 跑《消逝的光芒2》约 40 帧;
来自RenoDX Discord服务器的DLSS 5讨论
RTX 3090 跑《霍格沃茨之遗》约 30 帧。
来自RenoDX Discord服务器的DLSS 5讨论
最抽象的一个案例,则来自《赛博朋克 2077》。有人在 DLSS 5 跑到了 41 帧。
听起来好像突然又行了?
不过代价是:720P,DLSS 也拉到了最大。
来自RenoDX Discord服务器的DLSS 5讨论
为了让 AI 把画面变得更真实,先把原始画面糊成马赛克,也算是殊途同归了。
RTX 30 系表现会这么惨,其实也很好理解。
DLSS 5 这次主推的东西, 是 Neural Rendering(神经渲染)。
简单来说,传统游戏引擎仍然负责构建场景,再将游戏引擎提供的数据与已经渲染出的结果交给 AI 模型进一步处理,增强光照、材质、皮肤、头发等视觉效果,让画面进一步靠近照片级效果。
这东西本身就非常吃 AI 算力。
而 RTX 30 系 Ampere 架构最大的问题之一,就是没有原生 FP8 Tensor 运算支持。
当前泄露的 DLSS 5 模型使用了 FP8,而社区为 Ampere 制作的实验版本只能通过 FP16 等方式绕过去。
相比之下,RTX 40 系 Ada Lovelace 本身具备 FP8 运算能力,所以它的问题只是 DLL 中缺少适配 Ada 的 CUDA binary,所以适配性就好得多。
这次破解也挺有意思。
以前每当 NVIDIA 推出新一代DLSS 功能,总有声音说:老显卡到底是真跑不了,还是 NVIDIA 故意搞等级垄断?
目前的测试成绩来看,老黄确实没搞这套。
当然,现在拿这些成绩给正式版 DLSS 5 下定论还太早。
泄露的本质上只是《NBA 2K27》意外带出来的一份早期 DLSSNR 运行库,再经过第三方工具注入、修改 CUDA binary、实验性 FP16 Patch 等一系列操作。
和正式版还差得远。
更重要的是,截至目前,NVIDIA 只正式宣布 DLSS 5 将在 2026 年秋季推出,最终支持哪些 RTX 显卡仍未正式公布。
所以 RTX 30、40 系最后到底有没有机会获得官方支持,现在还没个定数。
但有件事可以确定。
按照现在这个折腾速度,等 NVIDIA 真把 DLSS 5 放出来的时候……
玩家可能已经替老黄把显卡测完了。
数据素材来源:NVIDIA、videocardz、Future、X,部分图源网络。


本文编辑:@ 阿红

©本文著作权归电手所有,未经电手许可,不得转载使用。