40系 DLSS 5 + 多帧生成,全被玩家解锁了

  40系玩家的怨念,大家懂的都懂:帧生成 2X 官方给了,50系独享的 3X/4X 多帧生成(MFG),死活不给。同一家店、同一个 DLSS 文件、同一套代码,就因为架构 ID 是 Ada 不是 Blackwell,选项直接给你锁死。老黄这刀法,属实精准。但最近这一个月,3X/4X 补帧解锁、帧节奏修复、甚至把 50系的补帧内核换给 40系用,一条龙全给你安排上了。 顺手,泄露版 DLSS 5 神经渲染也在 40系上跑起来了。同样我手上这张铭瑄4070s Turbo也是美美用上了。

【一、事情的起点:两条比较指令,划开了两代显卡】

社区项目 mfg-unlock 的作者把 DLSS-G 代码段扒了出来,发现 NVIDIA 的限制就这么点东西:两条对着架构 ID 的比较指令(cmp <reg>, 0x1B0),一条把多帧上限设成 1 或 5,另一条决定帧数能不能超过 1。

40系撞上这堵墙,上限就是 1——也就是你熟悉的 2X 帧生成。改掉这两条比较,3X/4X 直接出现在选项里。

作者在一张 RTX 4070 Ti 上实测,四个游戏全部成功:DOOM The Dark Ages(Vulkan)、GTA V 增强版、赛博朋克 2077、阿凡达:潘多拉边境(后三个都是 D3D12)。而且确认方式很硬核——DLSS-G 自带的诊断覆盖层直接显示 4X,不靠肉眼猜。

另一个项目 RTX40MFG-Unlock 走得更远:把 NVIDIA 对每个游戏的上限和 Streamline 包装器的容量上限取交集,理论上能捅到 6X,还带 ReShade 菜单实时切换倍率,DX12 和 Vulkan 通吃。当然 6X 属于极限操作,多数游戏实测还是 3X/4X 为主。

【二、光解锁不够:帧送达率才是手感】

到这你可能觉得:改两行代码就完事了?图样。

解锁之后有两个新问题:第一,15% 的帧是“堆”在上一帧上的——帧率数字好看,画面实际没多刷新;第二,进游戏时如果直接是 4X 状态,画面会错一下才恢复正常。

作者在 DOOM 里做了组对照实验(4X 状态,数据见上图):

  • 只开解锁:基准 48.7 fps,准时送达 72.5%,堆叠 15.4%

  • 加上“节奏器”补丁:准时率提到 88.8%,堆叠几乎清零

  • 再关掉硬件节拍:准时率 94.3%,堆叠 0.1%

那个“进游戏卡一下”的元凶也被找到了:帧生成内部有个计数器,跑到约 0.75 秒时会触发一次内部切换(flushAll + 命令上下文切换),节奏器补丁把它钉死,卡顿消失。

帧率数字是给别人看的,帧间隔才是给自己的。这句话,玩过补帧的都懂。

【三、真正的杀招:把 50系的补帧内核,塞回 40系】

作者发现:DLSS-G 的代码段里,31 个框架内核每个都带两份 PTX——一份给 Blackwell(compute_120),一份给 Ada(compute_89)。而且两份不是同一套源码:Ada 版会把布尔运算拆成约两百个 16 位谓词去跑,Blackwell 版根本不需要。

翻译成人话:同一份文件里,NVIDIA 给 40系塞的是效率更差的那套实现。

更离谱的是,Blackwell 那份 PTX 里没有任何 Blackwell 专属指令——全部 31 个内核都能原样汇编成 sm_89(40系)版本。其中 3 个编译后的大小刚好塞进原来内核占的空间,可以直接内存替换:

  • 运动矢量估计:2312 → 2160 条指令(-7%)

  • 逐像素修复:904 → 648(-28%)

  • 修复决策:752 → 576(-23%)

作者的原话:阿凡达在 4X 下,镜头转动时画面会抖(judder),换上这 3 个内核后完全流畅——同样的构建、同样的代码段、同样的设置,逐项排除后锁定的唯一变量。其中最关键的是运动矢量估计内核,症状也对得上:画面静止时一切正常,镜头一动就碎

如果你之前试过 3X/4X,觉得“怎么跟 2X 没差”,答案就在这:不是补帧没用,是 40系拿到的内核版本不行。

【四、五个补丁打包:这就是现在的 mfg-unlock】

把上面的东西打包,就是现在 GitHub 上的 mfg-unlock 项目。五个补丁,各管一件事:

  1. 架构门解锁(默认开):3X/4X 出现在选项里

  2. 节奏器(默认开):消灭进游戏的节奏切换卡顿

  3. 关闭硬件节拍(选配):准时率从 88.8% 拉到 94.3%

  4. 内核重建(默认开):换入 Blackwell 内核,画面稳定性质变

  5. 诊断覆盖层(选配):显示当前实际倍率,官方代码自证

最值得夸的是克制:全部补丁都在内存里完成,不写盘、不改游戏文件。 往游戏目录丢一个 version.dll 就完事,删掉即还原,机器恢复原样。

【五、番外:泄露的 DLSS 5,也在 40系上跑起来了】

多帧生成之外,还有一条更野的线:泄露版 DLSS 5 神经渲染

简单说下原理:DLSS 5 的神经渲染插件是个“挂件”,它只挂接游戏自己发出的 DLSS 调用——游戏不发,它就闲着。于是社区分两路打穿:

  • 游戏自带 DLSS 的:dlss5-bridge 把 DX11/Vulkan 游戏的调用镜像到私有 DX12 会话,插件有处可挂

  • 没有 DLSS 的游戏:DLSS5-Feeder 直接用 ReShade 的深度缓冲和运动矢量,自己伪造一份完整的 DLSS 请求——没有 DLSS 的游戏也能跑 DLSS 5

然后是懒人福音 DLSS5oneclick:一个 exe,自动扫 Steam/Epic/GOG/Xbox 库,选游戏点一下,上面这套全家桶自动装好。9 月 10 日的新版本还把 40系 MFG 解锁开关也加进来了(OptiScaler 路线的 AdaMfgUnlock 选项),40系用户勾一下就能开。

性能预期也给大家划好线了:DLSS 5 模型是 FP8 + 50系专属内核;社区流出的 310.8.SF 版补了 40系可用(还有给 20/30系的 FP16 路径)。代价分级很明确——50系全速、40系中等开销、20/30系重度开销。40系能用,但别指望白嫖满血。

【六、生态全景:这不是一个 mod,是一整条产业链】

mfg-unlock3X/4X 补帧解锁一个 DLL 解决,最纯粹的解锁派RTX40MFG-Unlock带菜单的通用解锁器ReShade 实时调倍率,冲 6X 用的DLSS5oneclick一键装 DLSS 5小白友好度拉满DLSS5-Feeder无 DLSS 游戏的“投喂器”思路最野的一个dlss5-bridgeDX11/Vulkan 桥接补齐最后一块拼图DLSS UnlockedDLSS 版本管理老游戏用新超分的老前辈

底层解锁代码(y4my4my4m 的 Ada 解锁、ShyVortex 的 MFG 工作)被多个项目互相集成,迭代速度快得惊人——光 9 月上旬就更新了好几轮。

NVIDIA 一边数着 50系的销量,一边看着社区把 40系的功能补到齐。 这画面,多少有点魔幻。

【七、红线预警:冲之前,把这四条焊死在脑子里】

最后是泼冷水环节,这部分请一个字一个字看完:

  1. 反作弊 = 封号红线。 这些全是 DLL 注入,正是反作弊重点盯防的行为。GTA V 带 BattlEye,网游和在线模式一律别碰,单机再玩。

  2. 只动内存的优先选。 mfg-unlock 全部内存补丁、删 DLL 即还原,安全档位最高;需要改文件、换 DLL 的方案,先备份再说。

  3. 别乱下“整合包”。 dlss5bridge.com 这类山寨站已被安全机构确认传播恶意程序(会尝试添加 Defender 排除项)。所有文件只从 GitHub 官方仓库 Release 页拿,拿到后核对 SHA-256。

  4. 预期管理。 目前的硬数据是一张 4070 Ti、一个人、四个游戏——4080/4090 理论上架构门一样能过,但没有公开实测。翻车表现包括花屏、黑屏、画面冻结,遇到了别慌,删 DLL 退回原样。

另外一个细节:驱动版本有讲究。DLSS5-Feeder 的测试显示,某些神经网络插件和 616.64 及以上驱动组合会直接跑不起来,616.56 则一切正常。玩之前先看清项目 README 的驱动兼容表。

回头看这事挺有意思:NVIDIA 用两条比较指令划出的世代墙,被玩家用五个内存补丁拆了;“50系专属”的 DLSS 5 内核,在 40系的显存里跑得明明白白。

40系不是不能,只是不被允许。

当然,还是那句老话:折腾有风险,动手需谨慎。单机游戏玩得飞起,网游账号千万别赌。

评论区聊聊:你的 40系打算冲几倍?已经试过的兄弟,来说说哪些游戏效果好、哪些翻车了?

更多游戏资讯请关注:电玩帮游戏资讯专区

电玩帮图文攻略 www.vgover.com