![]()
大家好,我是喫太飽騎士。有人想成爲我的前一千老粉嗎?有的話速速關注!
最近這兩天 AI 圈有關價格的八卦真不少,瓜是真的讓我喫到飽。 我也是迫不及待想給大家分享。
DeepSeek V4 Flash 正式發佈
當初梁叔叔說DeepSeek V4 會在 7 月中旬發佈,大家都翹首以盼。 結果梁叔叔重新定義了“中旬” 差點來了一出《梁宮春日的憂鬱:漫無止境的七月》。好在 Flash 的正式版在 7 月 31 日姍姍來遲。
![]()
正式版這次重點強化了 Agent、代碼生成和工具調用能力。 DeepSeek V4 Flash 的總參數規模約爲 284B,放在今天的模型陣營裏並不算特別誇張。但從官方測評來看,它卻可以和其他參數大得多的模型掰掰手腕。這是直接拿起”跨境界鬥法“的爽文主角劇本。 這也是 DeepSeek 一貫很有辨識度的路線:不單純追求把參數表做得更長,而是儘量把實際能力、推理成本和部署效率同時壓進一個模型裏。
但真正讓全網敲鑼打鼓的不是他的跑分,而是他的性價比。 V4 Flash 的普通輸入價格爲每百萬 Token 1 人民幣,輸出爲 2 人民幣;緩存命中後的輸入價格還要更低。 這個定價已經很難只用“便宜”來形容。就以我的昨天的測試結果來看,
![]()
![]()
我用了 3 億 Tokens,但花費僅僅是 1.61 元。僅僅是這個數據擺上來,我相信已經無需再多言。
更有意思的是,本次 DeepSeek 對 codex、claude code 等工具都做了適配優化,緩存率大大提高。社區反饋緩存率從更新前的80%——90%直接飆到了95%甚至 99%。這也是爲什麼我用了 3 億 Tokens,卻僅僅花費 1.61 元的原因。
而梁聖的這招”拖刀計“,不但震撼了等待近半個月的社區,也正巧打了其他兩家大模型公司措手不及。誰呢?
GLM 訂閱計劃改制
7 月 30 日,GLM Coding Plan 調整了訂閱規則。
一句話概括:實際上就是從 Coding Plan 變爲了 Token Plan 。
Token Plan :“按實際消耗的 Token 計費”,用多少算多少;Coding Plan :理解爲“按請求次數計費”,一次對話或調用算一次,不太區分內容長短。這是社區約定俗成的定義,我這裏也是簡單借用。實際上作爲產品名,提供方想怎麼起名就怎麼起名。
從技術和成本角度看,這種調整並不難理解。
![]()
在普通聊天階段,一次請求與另一次請求之間的成本差距可能還比較有限。但到了 Agent 和 AI 編程階段,有的請求只是解釋一段代碼,有的請求卻要讀取整個項目、連續調用工具,並進行多輪修改。
用 Token Plan 來取代 Coding Plan 在目前全世界算力緊張的大背景下其實是可以理解的。 但智譜這次的定價讓幾乎所有 C 端用戶都大跌眼鏡(這在我之前的帖子裏進行了詳細的分析,這裏就不詳述了)。簡單來說就是,價格漲,用量也漲,但性價比降低了。總之,在許多社區中,智譜都憑藉這波操作贏得了”Z/“的美名。
更不巧的是,智譜撞上了 DeepSeek V4 Flash 發佈。如果諸位仔細看過剛剛的 DeepSeek 的分數榜單的話,就會發現 744B 的 GLM 5.2 被 284B 的 DeepSeek V4 Flash 反超了。 而且更更不巧的是,目前各家旗艦國模裏,只有 GLM 5.2 不是多模態大模型。
DeepSeek V4 Flash 與 GLM 5.2 同屬非多模態大模型,無法處理圖片、音頻等信息。這導致它們倆是直接競爭對手。而其他國模還能夠憑藉多模態的特點在很多場景下逃過 DeepSeek V4 Flash 的性價比斬殺線。
而兩者的 API 的輸入 Token 價格差是8倍。
只能說這次智譜對用戶不夠”走心“,也不夠走運。那市場是否還會爲其”走個面“呢? 也許需要等智譜的下一代模型了。
GPT-5.6 降價
同樣是在 7 月 30 日,OpenAI 宣佈下調 GPT-5.6 部分模型的 API 價格。
![]()
其中,GPT-5.6 Luna 的輸入和輸出價格均下降了 80%。輸入從每百萬 Token 1 美元降至 0.2 美元(摺合約 1.3 人民幣),輸出從 6 美元降至 1.2 美元(摺合約 8.04 人民幣)。
GPT-5.6 Terra 的價格則下降了約 20%。
旗艦型號 Sol 沒有直接降價,但新增了速度更快、價格也更高的 Fast 模式。
這次調整最值得關注的是 Luna。降價之後,它進入了一個非常有競爭力的價格區間。
OpenAI 給出的解釋是,GPU 內核優化和推測解碼等技術改進降低了推理成本。換句話說,這並不只是一次短期促銷,而是模型服務效率提高以後,對價格體系進行的重新調整。
消息公佈以後,GPT-5.6 Luna 很快被一些開發者視爲新的性價比選手。從社區反饋來看,思考強度爲 max 的 GPT-5.6 Luna,在處理各類輕量的編程、Agent任務上都有不錯的表現。
那一刻,它似乎重新坐上了價格與能力平衡的王座。
但還是那句話:第二天,DeepSeek V4 Flash 正式版發佈了。
Luna 的輸入價格是每百萬 Token 0.2 美元,V4 Flash 是 0.14 美元;Luna 的輸出價格是 1.2 美元,V4 Flash 則是 0.28 美元。雖然從跑分來看,Luna 的性能還是略勝 V4 Flash 的。
但如果只討論“性價比”這個王座,GPT-5.6 Luna 這次大約只坐了半天。
DeepSeek 作爲一條藍色大鯨魚,像鯰魚一樣橫衝直撞地搗亂了整個 AI 市場。 這就是我愛 DeepSeek 的原因。愛死你了,藍色大鯨魚!
TRAE 中國改爲積分制
最後一條八卦,也是最讓我唏噓的。
我曾經是 Trae 的忠實用戶,在國際版還是按次計費的時候。那時候 Trae 裏還是 Claude 4 Sonnet 、GPT 5.4 等最新大模型。
![]()
這是我開始寫代碼後最好的一個夏天。 那時候 TRAE 裏還有 Sonnet 和 5.4,額度多得像用不完。我剛想到一個需求,就敢直接讓模型重構整個項目;報錯了不用自己查,繼續問;結果不滿意,也不用精打細算,直接開新對話再來一遍。 寫一週代碼,消耗的額度還沒有數字焦慮增長得快。每天打開 TRAE,都能在 Sonnet 和 5.4 之間隨便切換,彷彿頂級模型本來就應該像水和電一樣,永遠在那裏。 我說,那一刻讓人產生了‘人類正處在黃金時代’的錯覺。
可後來先是 Claude 從 Trae 下線,我理解,畢竟 A/ 排華。
然後是 TRAE 國際版改爲積分制。我也理解,畢竟按次付費我可以把字節薅禿(不是)。
最後是模型不再更新。我已經不再在乎,因爲我很少再使用 TRAE 了。
![]()
但我購買的年費 Pro 會員一直在。雖然每個月沒用,但我也沒去退款。也算一種“報答”?畢竟我開始 Vibe coding 和 Vibe Reseach 的每個最初的腳印都有 TRAE 的痕跡。
最近,TRAE 的中國版也改爲了積分制。
![]()
這在 TRAE 的用戶社區裏掀起了軒然大波。
![]()
其中具體的是非功過,其實沒啥好討論的。積分制是大勢所趨。沒有公司能做到一直“***”。TRAE 總有一個時刻會結束免費使用、付費加速的模式。畢竟國際版早就打了樣。
其實我們都知道,“按次付費”的時代結束了。以 KIMI K3爲起點,國模的性能直逼國際最先進的模型,國模的價格也不可能再想從前一樣“低廉”。
最後
AI 一直在燒錢,不燒公司的,就燒投資者的。不燒投資者的,也得燒用戶的。在經濟學規律下,無非是誰買單的問題。
但誰都沒想到吧!價格的尾巴還有我們梁叔叔拖着!
![]()
如果真的物有所值,用戶趕也趕不走。你覺得呢?
我是聊閒天的喫太飽騎士,一個混跡 AI 和科研圈的有趣靈魂。 歡迎關注、點贊、收藏。咱們下次再見!
對了,電電我吧,我什麼都會寫的。
更多遊戲資訊請關註:電玩幫遊戲資訊專區
電玩幫圖文攻略 www.vgover.com
