RTX 20老显卡也能帧率翻倍!老黄的「插帧底裤」被彻底扒了

今年装机,DIY 党算是憋屈到家了。

显卡贵、内存贵,新旧硬件都一个劲儿涨,原本咱们还隔三差五给大伙儿来一波硬件推荐,但今年这事儿阿红实在整不出来…
不过这也没拦住DIY 玩家,众所周知,DIY党有个优点:爱折腾。
以前大伙儿玩的还是超频、开核、刷 BIOS,想方设法从硬件里多榨一点性能出来。
现在画风已经变了,既然硬件整不起,咱们就玩玩软件。
而最近这几天,NVIDIA 都快被“玩坏了”…
前几天咱们才介绍过,原本 RTX 50 系独占的 DLSS 4.5 多帧生成,被玩家强行搬到了 RTX 40 系。
不过和 DLSS 5 的「3D神经渲染被搬到各个老显卡一样,DIY 大手子们一刻也没闲着,继续搞「技术下放
现在 RTX 30 系不仅跑上了多帧生成,甚至连 2018 年就已经登场的 RTX 20 系,都被玩家硬拖上了车。
是这样:
9 月 7 日,开发者 sdli1995 放出了一个名叫 「dlssg_for_sm86的开源项目。
这里的 SM86,指的就是 RTX 30 系显卡使用的安培架构。
和之前不少「老显卡开启 DLSS 帧生成的换皮方案不同,这次并不是把 AMD FSR 塞进去,再借 DLSS 的开关启动。
项目直接使用了 NVIDIA 原版 DLSSG 310.1 Runtime、模型和管线,再自己做了一套适配 RTX 30 系的后端。
翻译过来就是:还是老黄自己的插帧,只不过 NVIDIA 没给 30 系开,玩家自己挖了条通道走通了。
这和 RTX 40 系上车多帧生成的路线差不多。
效果嘛,还真的不错。
用 RTX 3080 Ti 实测了《黑神话:悟空》。4K分辨率下,关闭帧生成时大约 50 FPS,打开 2X 后来到 80 FPS,4X 更是直接冲到了 150 FPS 左右。
《赛博朋克 2077》路径追踪场景也从约 35 FPS,提高到了 2X 的 60 FPS和 4X 的 100 FPS。
不过开发者也明确表示,目前规范化的帧时间、延迟以及长期稳定性都还没有完整测试。
也就是说,具体游戏表现和延迟没定数,并且还有优化的空间。
如果说这还只是把新功能往前搬了一代,那紧接着出现的东西就更离谱了。
两天之后,又有人把这个项目改成了 「dlssg_for_sm75」。
SM75,对应的就是图灵架构,也就是 RTX 20 系。
RTX 2060 Max-Q 在《巫师 3》次世代版 DX12 中完成了真机测试,游戏里的帧生成可以正常开启,后端也成功加载。
并且有很多同学用这种方法也都跑起来了。
实现方法说起来也不算玄学。原版 DLSSG 310.1 里的 GPU Kernel 本身不是给图灵架构准备的,于是开发者重新做出了 SM75 能执行的版本,同时绕过了架构检查。
不过相比 30 系,20 系是要麻烦一些。
已有 RTX 2060 用户反馈,2X 模式基本能正常工作,帧数也确实能够明显提升;3X 开始出现较明显的鬼影,而 4X 目前效果就比较惨了,甚至有情况下性能还不如 AMD 的 FSR 。
看到这,可能有同学已经跃跃欲试了。阿红这里给大伙儿简单介绍下。
RTX 30 系用的是 「dlssg_for_sm86」。
进入 GitHub 项目页下载文件,地址:

https://github.com/sdli1995/dlssg_for_sm86

将「version.dll」和 「dlssg_sm86.ini」放到游戏真正的可执行EXE 目录旁边,再正常进入游戏开启「帧生成」即可。
目前项目默认最高可向游戏上报 4X,也就是每个真实帧最多额外生成 3 帧,不过最终能选择多少倍仍然由游戏决定。
RTX 20 系使用的则是 「dlssg_for_sm75」。
地址:https://github.com/Coldwood1026/dlssg_for_sm75
除了「version.dll」和配置文件,还需要把「dinput8.dll」以及整个 「runtime」文件夹一起放进游戏 EXE 目录,并清空 「%LOCALAPPDATA%\DlssgSm86\bundles\」中的旧缓存,再进游戏打开 帧生成即可。
这里不给大伙儿详细展开了,一方面这些项目更新速度很快,另一方面目前不同游戏之间的兼容性差别也挺大,30 系这边已经有人遇到游戏崩溃、多帧生成选项不显示以及画面伪影等问题。
有兴趣的同学可以根据项目地址折腾试试。
不过最重要的一点:仅限单机游戏使用,切勿使用网络游戏尝试哈,擅自修改文件很容易被封号。
那问题也来了。既然连 RTX 2060 都能把帧生成跑起来,那 NVIDIA 当年说老显卡不支持,是不是故意的?
这事倒也不能简单粗暴地归结为「纯软件锁
NVIDIA 当初推出 DLSS 3 时给出的解释,是 RTX 40 系拥有速度更高的 Optical Flow Accelerator 和第四代 Tensor Core;
想让前代架构支持帧生成,还需要针对光流算法和 AI 模型进一步优化。
而现在玩家自己折腾出来的结果,其实也能证明硬件差异确实存在。
30 系目前的效果和稳定性明显好于 20 系,到了图灵架构上,3X、4X 的问题也开始越来越多。
但另一方面,这些 Mod 至少也证明了一件事:
「官方不支持和「硬件完全跑不了,显然不是一码事。
总的来说,这可能也是 PC 圈最有意思的事儿了。DIY 精神这东西,看来还真没那么容易死。
数据素材来源:reddit、GitHub,部分图源网络。


本文编辑:@ 阿红

©本文著作权归电手所有,未经电手许可,不得转载使用。