前一陣子,各品牌顯卡工廠全面封倉、暫停出貨,等待8月重新定價,與此同時國內RTX 5090的售價已經近4萬元,RTX 5070 Ti國內渠道報價也站上了一萬元關口。
顯卡越來越貴,已經從消費品變成了理財產品。
但這一次,等等黨可能真的能贏,只不過贏法跟所有人想的不太一樣:並不是等獨顯降價,是等另外一個品類追上。
一、不僅內存更大,還更便宜更省電
別急着反駁,從宏觀來看,現在是什麼時代?
大模型時代。
現在的個人電腦作爲大模型載體,就算搭載獨顯裏最強的5090,跑一個70B參數的模型夠用,但120B以上或者同時跑多個模型馬上降速。
這就是現在獨顯的短板:算力冗餘,卻被顯存焊死了天花板。
那麼怎麼辦?這就是開頭說的另一個品類:統一內存電腦。
有人就會說了,統一內存電腦,這我知道啊,動不動就64G,128G內存,現在的內存又堪比黃金,不得貴死?
![]()
恰恰相反,它比獨顯便宜得多。
算一筆賬:傳統PC的獨立顯存是GDDR6或GDDR7做的,GDDR7目前每GB大約8到10美元,一塊16GB顯存光顆粒成本就接近150美元。
而LPDDR5X每GB只有2到2.5美元,128GB統一內存的顆粒成本大約250到320美元。
這麼一比較,每GB有效成本直接差出一個數量級,更重要的是,這128GB還能當成顯存,它反而是市面上最便宜的顯存方案。
儘管整機溢價目前還在(現在買大內存的統一內存整機確實不便宜),但顆粒成本低是上游趨勢,下半年聯想惠普宏碁進來卷之後,價格將會逐漸下降,當年SSD剛出也貴,現在呢?
如果你去AI開源社區看一眼,會發現拿Mac跑大模型的人早就不是少數了,就是因爲蘋果那套統一內存方案,是目前唯一能在個人設備上把120B模型裝進去還不用掏4萬塊的選擇(如果你就是追求極致速度,統一內存目前不適合你)。
其次,CPU,GPU,集成封裝的優勢會帶來功耗的優勢。
統一內存把CPU、GPU、內存控制器全部封裝在一顆SoC裏,信號路徑從幾十毫米縮短到封裝基板上的幾個毫米,不用像傳統PC那樣到處走線。
今年Computex期間,多家海外硬件評測機構的實測顯示,蘋果M系列芯片以30瓦級別的整機功耗,在大模型推理任務上跑出了傳統150瓦獨顯平臺70%到80%的性能,單位功耗產出的token數是傳統獨顯平臺的3到5倍。
這就有人會問了,照你這麼說,統一內存就完美無瑕了唄,還說啥了,算你贏得了。
別這麼說啊,我也沒有吹統一內存電腦,它當然不是萬能的。
二、遊戲性能打不過獨顯,但從0到1已經完成
我們以英偉達已經發布的RTX Spark爲例,這是一顆把Blackwell RTX GPU和20核Grace CPU焊在一起的消費級超級芯片。
RTX Spark的GPU部分塞了6144個CUDA核心,跟RTX 5070筆記本版是同款規模,128GB LPDDR5X統一內存,本地能跑120B參數模型加百萬token上下文。
前文在比較內存顆粒價格的時候,相信有不少人疑惑:兩種內存顆粒,怎麼就放一起比較?
這就是我想說的統一內存最大的短板:因爲成本限制,只能採用LPDDR(5x),而LPDDR5X的系統內存帶寬只有大約273GB每秒,桌面版5070配的是GDDR7顯存,帶寬672GB每秒,差了近三倍。
因爲遊戲場景裏紋理、幾何、光影數據全從內存帶寬過,LPDDR5X這條273GB每秒的窄水管拖了後腿。
Computex期間,多家硬件評測機構的實測也顯示,在未經UMA專門優化的傳統3A遊戲場景下,同算力的統一內存平臺比傳統獨顯方案幀率低15%到25%。
![]()
至於英偉達在發佈會上說玩3A能1440p跑100幀以上,肯定是靠DLSS的幀生成硬堆上去的,關掉插幀後原生幀率能到40就算它厲害了。
當顯存的優勢被夷平後,帶寬就成了獨顯最後的護城河,也成了統一內存下一個要啃的骨頭。
但對於科技產品來說,這並不是什麼問題,因爲基本都是先拿半成品上市,完成從零到一的跨越,剩下的就是堆參數做優化的事情,
所以說這個短板恰恰是迭代的起跑線,而不是終點。
核心數可以繼續從6144往上堆,因爲Blackwell架構本身就留了擴展空間;帶寬方面,三星和SK海力士的LPDDR6今年底量產,可用帶寬從約273 GB/s提升到約415 GB/s,提升近50%,並大幅拉近與GDDR7之間的差距。
雖然幀率不會等比例翻倍,但足以把目前15%-25%的差距大幅縮小。
包括什麼散熱搶電還有位寬的問題,廠商不斷優化就行了。
三、統一內存是大勢所趨,但獨顯也不會消失
說了這麼多,我的意思是,電子產品的小型化,集成化是趨勢,統一內存電腦在大模型時代將慢慢成爲主流。
這和當年電動車追上燃油車的邏輯有相似之處,電動車剛出的時候續航一樣拉胯,靠的是能源效率和結構簡化慢慢做到今天的地步。
統一內存也一樣,不和獨顯拼算力更高,而是靠架構紅利,先把“能裝下”這個事搞定,速度再慢慢迭代。
![]()
目前的統一內存電腦,蘋果用了六年時間把這條路從0走到1,從2020年M1到最新的M4,每一步都在證明消費端統一內存不但是可行的,而且正在喫掉傳統PC的市場份額。
AMD更是搶在英偉達之前提前佔位,銳龍AI MAX PRO 400系列用192GB統一內存鎖定了AI工作站這個細分市場。
英偉達在GTC臺北正式發佈RTX Spark之後,宏碁、華碩、聯想、戴爾、惠普、微軟、微星七大OEM廠全部宣佈跟進,首批搭載RTX Spark的筆記本和小型臺式機預計今年秋季開始交付。
如果統一內存只有蘋果和AMD在搞,倒是可以認爲統一內存就是個空中樓閣,是個小衆概念,但現在全球最大的獨顯頭子英偉達都下場了,一個最希望獨顯不被替代的公司都開始做統一內存了,那隻能說統一內存變成了“整個PC行業在搞的那個東西”。
入場的人一多,統一內存電腦的價格自然就會下降。
這和當年電動車取代燃油車的邏輯如出一轍,電動車不是靠跑得更快贏的,是靠能源效率和機械結構簡化贏的。
統一內存不是靠算力更高贏的,是靠架構紅利贏的:同樣的容量成本更低,可以塞更多更大的模型,雖然速度慢,但同樣的功耗產出更多,故障率還低。
當這三個條件同時成立的時候,主流市場的天平就會開始傾斜。
但獨顯並不會消失,就像燃油車不會滅絕一樣,對於有遊戲需求和跑打大模型需求的用戶來說,統一內存電腦是最佳選擇,但如果單純是希望4k光追畫質拉滿的遊戲發燒玩家或者是專業工作室做8K視頻渲染和工業級3D建模,那獨顯可能還是最好的選擇。
更多遊戲資訊請關註:電玩幫遊戲資訊專區
電玩幫圖文攻略 www.vgover.com
