![]()
大家好,我是吃太饱骑士。有人想成为我的前一千老粉吗?有的话速速关注!
最近这两天 AI 圈有关价格的八卦真不少,瓜是真的让我吃到饱。 我也是迫不及待想给大家分享。
DeepSeek V4 Flash 正式发布
当初梁叔叔说DeepSeek V4 会在 7 月中旬发布,大家都翘首以盼。 结果梁叔叔重新定义了“中旬” 差点来了一出《梁宫春日的忧郁:漫无止境的七月》。好在 Flash 的正式版在 7 月 31 日姗姗来迟。
![]()
正式版这次重点强化了 Agent、代码生成和工具调用能力。 DeepSeek V4 Flash 的总参数规模约为 284B,放在今天的模型阵营里并不算特别夸张。但从官方测评来看,它却可以和其他参数大得多的模型掰掰手腕。这是直接拿起”跨境界斗法“的爽文主角剧本。 这也是 DeepSeek 一贯很有辨识度的路线:不单纯追求把参数表做得更长,而是尽量把实际能力、推理成本和部署效率同时压进一个模型里。
但真正让全网敲锣打鼓的不是他的跑分,而是他的性价比。 V4 Flash 的普通输入价格为每百万 Token 1 人民币,输出为 2 人民币;缓存命中后的输入价格还要更低。 这个定价已经很难只用“便宜”来形容。就以我的昨天的测试结果来看,
![]()
![]()
我用了 3 亿 Tokens,但花费仅仅是 1.61 元。仅仅是这个数据摆上来,我相信已经无需再多言。
更有意思的是,本次 DeepSeek 对 codex、claude code 等工具都做了适配优化,缓存率大大提高。社区反馈缓存率从更新前的80%——90%直接飙到了95%甚至 99%。这也是为什么我用了 3 亿 Tokens,却仅仅花费 1.61 元的原因。
而梁圣的这招”拖刀计“,不但震撼了等待近半个月的社区,也正巧打了其他两家大模型公司措手不及。谁呢?
GLM 订阅计划改制
7 月 30 日,GLM Coding Plan 调整了订阅规则。
一句话概括:实际上就是从 Coding Plan 变为了 Token Plan 。
Token Plan :“按实际消耗的 Token 计费”,用多少算多少;Coding Plan :理解为“按请求次数计费”,一次对话或调用算一次,不太区分内容长短。这是社区约定俗成的定义,我这里也是简单借用。实际上作为产品名,提供方想怎么起名就怎么起名。
从技术和成本角度看,这种调整并不难理解。
![]()
在普通聊天阶段,一次请求与另一次请求之间的成本差距可能还比较有限。但到了 Agent 和 AI 编程阶段,有的请求只是解释一段代码,有的请求却要读取整个项目、连续调用工具,并进行多轮修改。
用 Token Plan 来取代 Coding Plan 在目前全世界算力紧张的大背景下其实是可以理解的。 但智谱这次的定价让几乎所有 C 端用户都大跌眼镜(这在我之前的帖子里进行了详细的分析,这里就不详述了)。简单来说就是,价格涨,用量也涨,但性价比降低了。总之,在许多社区中,智谱都凭借这波操作赢得了”Z/“的美名。
更不巧的是,智谱撞上了 DeepSeek V4 Flash 发布。如果诸位仔细看过刚刚的 DeepSeek 的分数榜单的话,就会发现 744B 的 GLM 5.2 被 284B 的 DeepSeek V4 Flash 反超了。 而且更更不巧的是,目前各家旗舰国模里,只有 GLM 5.2 不是多模态大模型。
DeepSeek V4 Flash 与 GLM 5.2 同属非多模态大模型,无法处理图片、音频等信息。这导致它们俩是直接竞争对手。而其他国模还能够凭借多模态的特点在很多场景下逃过 DeepSeek V4 Flash 的性价比斩杀线。
而两者的 API 的输入 Token 价格差是8倍。
只能说这次智谱对用户不够”走心“,也不够走运。那市场是否还会为其”走个面“呢? 也许需要等智谱的下一代模型了。
GPT-5.6 降价
同样是在 7 月 30 日,OpenAI 宣布下调 GPT-5.6 部分模型的 API 价格。
![]()
其中,GPT-5.6 Luna 的输入和输出价格均下降了 80%。输入从每百万 Token 1 美元降至 0.2 美元(折合约 1.3 人民币),输出从 6 美元降至 1.2 美元(折合约 8.04 人民币)。
GPT-5.6 Terra 的价格则下降了约 20%。
旗舰型号 Sol 没有直接降价,但新增了速度更快、价格也更高的 Fast 模式。
这次调整最值得关注的是 Luna。降价之后,它进入了一个非常有竞争力的价格区间。
OpenAI 给出的解释是,GPU 内核优化和推测解码等技术改进降低了推理成本。换句话说,这并不只是一次短期促销,而是模型服务效率提高以后,对价格体系进行的重新调整。
消息公布以后,GPT-5.6 Luna 很快被一些开发者视为新的性价比选手。从社区反馈来看,思考强度为 max 的 GPT-5.6 Luna,在处理各类轻量的编程、Agent任务上都有不错的表现。
那一刻,它似乎重新坐上了价格与能力平衡的王座。
但还是那句话:第二天,DeepSeek V4 Flash 正式版发布了。
Luna 的输入价格是每百万 Token 0.2 美元,V4 Flash 是 0.14 美元;Luna 的输出价格是 1.2 美元,V4 Flash 则是 0.28 美元。虽然从跑分来看,Luna 的性能还是略胜 V4 Flash 的。
但如果只讨论“性价比”这个王座,GPT-5.6 Luna 这次大约只坐了半天。
DeepSeek 作为一条蓝色大鲸鱼,像鲶鱼一样横冲直撞地捣乱了整个 AI 市场。 这就是我爱 DeepSeek 的原因。爱死你了,蓝色大鲸鱼!
TRAE 中国改为积分制
最后一条八卦,也是最让我唏嘘的。
我曾经是 Trae 的忠实用户,在国际版还是按次计费的时候。那时候 Trae 里还是 Claude 4 Sonnet 、GPT 5.4 等最新大模型。
![]()
这是我开始写代码后最好的一个夏天。 那时候 TRAE 里还有 Sonnet 和 5.4,额度多得像用不完。我刚想到一个需求,就敢直接让模型重构整个项目;报错了不用自己查,继续问;结果不满意,也不用精打细算,直接开新对话再来一遍。 写一周代码,消耗的额度还没有数字焦虑增长得快。每天打开 TRAE,都能在 Sonnet 和 5.4 之间随便切换,仿佛顶级模型本来就应该像水和电一样,永远在那里。 我说,那一刻让人产生了‘人类正处在黄金时代’的错觉。
可后来先是 Claude 从 Trae 下线,我理解,毕竟 A/ 排华。
然后是 TRAE 国际版改为积分制。我也理解,毕竟按次付费我可以把字节薅秃(不是)。
最后是模型不再更新。我已经不再在乎,因为我很少再使用 TRAE 了。
![]()
但我购买的年费 Pro 会员一直在。虽然每个月没用,但我也没去退款。也算一种“报答”?毕竟我开始 Vibe coding 和 Vibe Reseach 的每个最初的脚印都有 TRAE 的痕迹。
最近,TRAE 的中国版也改为了积分制。
![]()
这在 TRAE 的用户社区里掀起了轩然大波。
![]()
其中具体的是非功过,其实没啥好讨论的。积分制是大势所趋。没有公司能做到一直“***”。TRAE 总有一个时刻会结束免费使用、付费加速的模式。毕竟国际版早就打了样。
其实我们都知道,“按次付费”的时代结束了。以 KIMI K3为起点,国模的性能直逼国际最先进的模型,国模的价格也不可能再想从前一样“低廉”。
最后
AI 一直在烧钱,不烧公司的,就烧投资者的。不烧投资者的,也得烧用户的。在经济学规律下,无非是谁买单的问题。
但谁都没想到吧!价格的尾巴还有我们梁叔叔拖着!
![]()
如果真的物有所值,用户赶也赶不走。你觉得呢?
我是聊闲天的吃太饱骑士,一个混迹 AI 和科研圈的有趣灵魂。 欢迎关注、点赞、收藏。咱们下次再见!
对了,电电我吧,我什么都会写的。
更多游戏资讯请关注:电玩帮游戏资讯专区
电玩帮图文攻略 www.vgover.com
