反超 Fable 5,智谱开源模型登顶Design Arena

前天放假在家,闲来无事刷推,然后看到关注的@Designarena发了条文章:


他们刚放出了最新一版的单轮 Web Design 榜单,第一名居然是—— GLM-5.2。

也就是说,GLM-5.2 这次至少网页设计这块,战胜了 Claude Fable 5、Opus 4.8还有 GPT-5.5 等一众强力对手。


这条文章我反复又看了好几次,字面意思上——按之前的惯性思维,这类榜单我已经习惯看到 Anthropic 的模型在上面轮换霸榜,闭源、贵、偶尔高峰期还要拥堵,,,结果这次排第一的是个 MIT 许可的开源模型,价格跟A\一比也便宜不少。

先说下 Design Arena 是干嘛的。


简单讲就是给一堆模型丢同样的网页设计需求,让它们一次性吐出一个能用的网页,然后让真人投票(如果你玩过LMArena就很容易理解)。


做网页最难点不在于写代码,是同时要做布局、视觉层次、排版、交互动画、内容结构这一堆决策,单轮不能重试——落地页一丑,这轮基本就废了。


过去这种活儿,闭源大厂是有统治力的,结果这次 GLM 5.2 比 Claude Fable 5 高了 15 个 Elo。

各位要知道,GLM-5.2 只有 744B 参数,并且不是多模态模型,也就是说它连视觉能力都没有。


这就有意思了。


价格这块也得提一嘴,Fable 5 的 API 定价是 $10/$50 per million tokens,GLM 5.2 是 $1.40/$4.40,直接便宜了七到十一倍。

除了最终的成品优秀,Design Arena 在报告里还提到,GLM 5.2 在各种库的调用上丝滑流畅,Tailwind 使用率高达 91%,没出现调用了但忘了用的尴尬情况。


早期 AI 写前端最经典的一个反模式就是紫色渐变糊一脸,这次 GLM 5.2 反而主动避开了。它倾向于生成模板化但高质量、一致性极强的设计,平均输出质量比 Fable 5 那种更发散的写法更讨人喜欢。

当然,代价也是有的。


精美的网页需要时间来堆砌——平均 304 秒一个,是 Fable 5 的两倍时间。你可以理解成它愿意花时间扣细节,但最佳输出长度有个甜点区间,46K 到 57K 字符,再长就开始 diminishing returns,这点倒挺诚实。

聊到这里我得插一句时机。


GLM 5.2 最近被国内外很多媒体、机构、众多开发者提起,以及这次的网页设计登顶,发生在一个非常戏剧化的背景里。


各位都知道,本月12号,白房子以安全为由,给 Anthropic 下了一道出口管制指令,指令范围非常夸张,要求 Anthropic 禁止任何外国国民访问 Fable 5 和 Mythos 5,不管这个人在大美丽还是境外,连 Anthropic 自己的外籍员工都不行。

Anthropic 想了想,最后干脆全球下线了这两款模型——存活四天光荣下线。


紧接着的第二天,6 月 13 号,智谱宣布北京时间下午5:21,GLM-5.2 全面开放给所有 GLM Coding Plan 用户,没几天后,再以 MIT 许可正式开源,没有任何地理或访问限制。


开源模型的含金量,想必我不用多说吧,今天下载下来,明天谁下指令来也撤不走的开放权重。


所以你能看到今天这次港股智谱的反应有多剧烈。


盘中最高涨了将近 48%,截至撰写本文时,收涨约 32.8%。

总市值突破 1 万亿港币。


这个剧本放在一年前,我是不信的。


再说一个有趣的事,由于其开源的特性,目前已经有一些美国企业都开始认真评估迁移到 GLM 5.2。我一开始也觉得有点夸张,但仔细想想逻辑是通的:


现在大家在AI上都舍得花钱,在实力面前,成本成了可讨论的——可控性,开源的智谱拿来自己部署(虽然成本也不低)不会被一纸指令撤销,基准表现在目前也是顶尖梯队。

对一个被合规和供应链折腾得头大的 CTO 来说,这种属性几乎是按需定制的。


写到这里,我不想把这这篇内容写成“国内 AI 反超大美丽”,这种内容听着爽但容易翻车,各位看多了也不喜欢看。但开源模型的访问连续性、可靠性在这件事上对闭源模型的结构性优势,是一次无比直观的体现了。


不过,话说到这里,各位也要清楚,GLM 5.2 不是无敌的。


Design Arena 的其他类别里,它在 Game Dev、Data Visualization、3D 设计都排第二,UI Component 排第四。它是纯文本模型,没有视觉能力,多模态这块也还是硬伤,生成速度也慢,304 秒一个网页,对急性子不太友好。

更广泛地说,在最复杂的前沿智能、长程 agent 任务、整个开发者生态的成熟度上,跟顶级闭源模型比还有差距,这点智谱自己也清楚,没必要嘴硬。


我个人的态度是,正视差距,但别把这次登顶不当回事。


几个月前的 SOTA,今天已经被一个任何人都能下载、微调、本地部署的开源模型追上甚至反超。这件事的速度感比登顶本身更值得停下来想一想。闭源护城河的窗口期正在被逐渐压缩,开源的工程化能力上了一个台阶,接下来这种开源模型打闭源的情况会越来越频繁——就像一年之前的 DeepSeek-R1 一样。

让我们再次赞叹智谱Z.AI团队这次干得漂亮,但漂亮完之后,该补的课得继续补,该追的差距得继续追。


乐观和清醒不是对立的。


心怀理想,继续前行。

更多游戏资讯请关注:电玩帮游戏资讯专区

电玩帮图文攻略 www.vgover.com