![]()
40系玩家的怨念,大家懂的都懂:幀生成 2X 官方給了,50系獨享的 3X/4X 多幀生成(MFG),死活不給。同一家店、同一個 DLSS 文件、同一套代碼,就因爲架構 ID 是 Ada 不是 Blackwell,選項直接給你鎖死。老黃這刀法,屬實精準。但最近這一個月,3X/4X 補幀解鎖、幀節奏修復、甚至把 50系的補幀內核換給 40系用,一條龍全給你安排上了。 順手,泄露版 DLSS 5 神經渲染也在 40繫上跑起來了。同樣我手上這張銘瑄4070s Turbo也是美美用上了。
![]()
【一、事情的起點:兩條比較指令,劃開了兩代顯卡】
社區項目 mfg-unlock 的作者把 DLSS-G 代碼段扒了出來,發現 NVIDIA 的限制就這麼點東西:兩條對着架構 ID 的比較指令(cmp <reg>, 0x1B0),一條把多幀上限設成 1 或 5,另一條決定幀數能不能超過 1。
40系撞上這堵牆,上限就是 1——也就是你熟悉的 2X 幀生成。改掉這兩條比較,3X/4X 直接出現在選項裏。
作者在一張 RTX 4070 Ti 上實測,四個遊戲全部成功:DOOM The Dark Ages(Vulkan)、GTA V 增強版、賽博朋克 2077、阿凡達:潘多拉邊境(後三個都是 D3D12)。而且確認方式很硬核——DLSS-G 自帶的診斷覆蓋層直接顯示 4X,不靠肉眼猜。
另一個項目 RTX40MFG-Unlock 走得更遠:把 NVIDIA 對每個遊戲的上限和 Streamline 包裝器的容量上限取交集,理論上能捅到 6X,還帶 ReShade 菜單實時切換倍率,DX12 和 Vulkan 通喫。當然 6X 屬於極限操作,多數遊戲實測還是 3X/4X 爲主。
【二、光解鎖不夠:幀送達率纔是手感】
![]()
到這你可能覺得:改兩行代碼就完事了?圖樣。
解鎖之後有兩個新問題:第一,15% 的幀是“堆”在上一幀上的——幀率數字好看,畫面實際沒多刷新;第二,進遊戲時如果直接是 4X 狀態,畫面會錯一下才恢復正常。
作者在 DOOM 裏做了組對照實驗(4X 狀態,數據見上圖):
只開解鎖:基準 48.7 fps,準時送達 72.5%,堆疊 15.4%
加上“節奏器”補丁:準時率提到 88.8%,堆疊幾乎清零
再關掉硬件節拍:準時率 94.3%,堆疊 0.1%
那個“進遊戲卡一下”的元兇也被找到了:幀生成內部有個計數器,跑到約 0.75 秒時會觸發一次內部切換(flushAll + 命令上下文切換),節奏器補丁把它釘死,卡頓消失。
幀率數字是給別人看的,幀間隔纔是給自己的。這句話,玩過補幀的都懂。
【三、真正的殺招:把 50系的補幀內核,塞回 40系】
![]()
作者發現:DLSS-G 的代碼段裏,31 個框架內核每個都帶兩份 PTX——一份給 Blackwell(compute_120),一份給 Ada(compute_89)。而且兩份不是同一套源碼:Ada 版會把布爾運算拆成約兩百個 16 位謂詞去跑,Blackwell 版根本不需要。
翻譯成人話:同一份文件裏,NVIDIA 給 40系塞的是效率更差的那套實現。
更離譜的是,Blackwell 那份 PTX 裏沒有任何 Blackwell 專屬指令——全部 31 個內核都能原樣彙編成 sm_89(40系)版本。其中 3 個編譯後的大小剛好塞進原來內核佔的空間,可以直接內存替換:
運動矢量估計:2312 → 2160 條指令(-7%)
逐像素修復:904 → 648(-28%)
修復決策:752 → 576(-23%)
作者的原話:阿凡達在 4X 下,鏡頭轉動時畫面會抖(judder),換上這 3 個內核後完全流暢——同樣的構建、同樣的代碼段、同樣的設置,逐項排除後鎖定的唯一變量。其中最關鍵的是運動矢量估計內核,症狀也對得上:畫面靜止時一切正常,鏡頭一動就碎。
如果你之前試過 3X/4X,覺得“怎麼跟 2X 沒差”,答案就在這:不是補幀沒用,是 40系拿到的內核版本不行。
【四、五個補丁打包:這就是現在的 mfg-unlock】
![]()
把上面的東西打包,就是現在 GitHub 上的 mfg-unlock 項目。五個補丁,各管一件事:
架構門解鎖(默認開):3X/4X 出現在選項裏
節奏器(默認開):消滅進遊戲的節奏切換卡頓
關閉硬件節拍(選配):準時率從 88.8% 拉到 94.3%
內核重建(默認開):換入 Blackwell 內核,畫面穩定性質變
診斷覆蓋層(選配):顯示當前實際倍率,官方代碼自證
最值得誇的是剋制:全部補丁都在內存裏完成,不寫盤、不改遊戲文件。 往遊戲目錄丟一個 version.dll 就完事,刪掉即還原,機器恢復原樣。
【五、番外:泄露的 DLSS 5,也在 40繫上跑起來了】
![]()
多幀生成之外,還有一條更野的線:泄露版 DLSS 5 神經渲染。
簡單說下原理:DLSS 5 的神經渲染插件是個“掛件”,它只掛接遊戲自己發出的 DLSS 調用——遊戲不發,它就閒着。於是社區分兩路打穿:
遊戲自帶 DLSS 的:dlss5-bridge 把 DX11/Vulkan 遊戲的調用鏡像到私有 DX12 會話,插件有處可掛
沒有 DLSS 的遊戲:DLSS5-Feeder 直接用 ReShade 的深度緩衝和運動矢量,自己僞造一份完整的 DLSS 請求——沒有 DLSS 的遊戲也能跑 DLSS 5
然後是懶人福音 DLSS5oneclick:一個 exe,自動掃 Steam/Epic/GOG/Xbox 庫,選遊戲點一下,上面這套全家桶自動裝好。9 月 10 日的新版本還把 40系 MFG 解鎖開關也加進來了(OptiScaler 路線的 AdaMfgUnlock 選項),40系用戶勾一下就能開。
性能預期也給大家劃好線了:DLSS 5 模型是 FP8 + 50系專屬內核;社區流出的 310.8.SF 版補了 40系可用(還有給 20/30系的 FP16 路徑)。代價分級很明確——50系全速、40系中等開銷、20/30系重度開銷。40系能用,但別指望白嫖滿血。
【六、生態全景:這不是一個 mod,是一整條產業鏈】
![]()
mfg-unlock3X/4X 補幀解鎖一個 DLL 解決,最純粹的解鎖派RTX40MFG-Unlock帶菜單的通用解鎖器ReShade 實時調倍率,衝 6X 用的DLSS5oneclick一鍵裝 DLSS 5小白友好度拉滿DLSS5-Feeder無 DLSS 遊戲的“投餵器”思路最野的一個dlss5-bridgeDX11/Vulkan 橋接補齊最後一塊拼圖DLSS UnlockedDLSS 版本管理老遊戲用新超分的老前輩
底層解鎖代碼(y4my4my4m 的 Ada 解鎖、ShyVortex 的 MFG 工作)被多個項目互相集成,迭代速度快得驚人——光 9 月上旬就更新了好幾輪。
NVIDIA 一邊數着 50系的銷量,一邊看着社區把 40系的功能補到齊。 這畫面,多少有點魔幻。
【七、紅線預警:衝之前,把這四條焊死在腦子裏】
![]()
最後是潑冷水環節,這部分請一個字一個字看完:
反作弊 = 封號紅線。 這些全是 DLL 注入,正是反作弊重點盯防的行爲。GTA V 帶 BattlEye,網遊和在線模式一律別碰,單機再玩。
只動內存的優先選。 mfg-unlock 全部內存補丁、刪 DLL 即還原,安全檔位最高;需要改文件、換 DLL 的方案,先備份再說。
別亂下“整合包”。 dlss5bridge.com 這類山寨站已被安全機構確認傳播惡意程序(會嘗試添加 Defender 排除項)。所有文件只從 GitHub 官方倉庫 Release 頁拿,拿到後覈對 SHA-256。
預期管理。 目前的硬數據是一張 4070 Ti、一個人、四個遊戲——4080/4090 理論上架構門一樣能過,但沒有公開實測。翻車表現包括花屏、黑屏、畫面凍結,遇到了別慌,刪 DLL 退回原樣。
另外一個細節:驅動版本有講究。DLSS5-Feeder 的測試顯示,某些神經網絡插件和 616.64 及以上驅動組合會直接跑不起來,616.56 則一切正常。玩之前先看清項目 README 的驅動兼容表。
回頭看這事挺有意思:NVIDIA 用兩條比較指令劃出的世代牆,被玩家用五個內存補丁拆了;“50系專屬”的 DLSS 5 內核,在 40系的顯存裏跑得明明白白。
40系不是不能,只是不被允許。
當然,還是那句老話:折騰有風險,動手需謹慎。單機遊戲玩得飛起,網遊賬號千萬別賭。
評論區聊聊:你的 40系打算衝幾倍?已經試過的兄弟,來說說哪些遊戲效果好、哪些翻車了?
更多遊戲資訊請關註:電玩幫遊戲資訊專區
電玩幫圖文攻略 www.vgover.com
