本文作者:程序员小灰(@XiaohuiAI666)。版权归作者所有,未经授权禁止转载。


大家好,我是程序员小灰。

在 8 月 20 日,AI 圈子多了一个大模型盲盒。

Article image

一个叫 Ox-Alpha 的匿名模型悄悄上线 OpenRouter 和 OpenCode,100 万上下文,多模态,免费试用,除此之外没有任何信息。几天时间,它冲上两个平台的第一名,创下调用量新高。

全网开始竞猜它是谁家的:小米 MiMo、Grok、Gemini 马甲,全被猜了一遍。

由于Ox是“牛”的意思,刚好电影《牛来》正在爆火,于是AI中文社区都把这款匿名模型戏称为“牛来”大模型。

Article image

一直到 8 月 26 日晚,盲盒正式拆开:这个所谓的“牛来”模型,正是智谱旗下的 GLM-5.3-Flash。

悬念只是开胃菜,真正的冲击是官方给的这两个数:Artificial Analysis 综合智能指数 57 分,和 Claude Opus 4.8 持平;限时价格,约为 Opus 4.8 的 1/40。

Article image

一款能够和 Opus 4.8 掰手腕,同时价格压到这个水平的模型,值得大家花 5 分钟了解一番;不想付费体验的,文末整理了免费与省钱的使用途径,有需要可以直接跳转文末。

先说清楚,这是个什么模型

它名字叫 Flash,但它既不是缩量小模型,也不是简单的阉割版本,而是基于全新旗舰底座打造的高性价比版本。

Article image

翻译成人话:

320B 总参、18B 激活:大脑总共 3200 亿参数,每次干活只点亮 180 亿,所以又快又省。

原生多模态,还带视频:不是外挂一个视觉编码器,是预训练阶段就把眼睛长进了脑子里。图像、视频、文本一起吃,这在 GLM-5 系列是第一次。

全新预训练,不是蒸馏款:市面上很多"-Flash""-mini"是把大模型一刀切小的版本,这个不是,30 万亿 token 从头练的全新模型。

它在系列里的位置一句话讲完:能力全面超越参数量高它一倍的 GLM-5.2,价格只有 GLM-5.2 的十分之一。

架构瘦身也下得去手:总参数量和 GLM-4.5 的 355B 一个量级,激活参数从 32B 砍到 18B,层数从 92 砍到 45,几乎对半。

Article image

价格:真正的断层在这

跑分开头说过了,智能指数 57 追平 Opus 4.8,只补一句丑话:追平的意思是每一项都还略差一口气,别拿"持平"当"反超"宣传。

Article image

重点看价格,每百万 token 摆在一起:

Article image

对比表格可以直观看到双方价差。8 月 17 日 DeepSeek 刚刚官宣涨价,仅仅两周后智谱就公布了极具冲击力的定价,行业价格格局因此发生明显变化。

用起来什么感觉:我自己跑了一遍

前面把跑分和价格都讲完了,但都是纸面判断。模型到底行不行,还得自己上手。我挑了两个最直观的:案例一让它一句 prompt 做个敦煌飞天页面,看前端功力;案例二把作品录屏喂回给它,看它有没有自知之明。过程和结果全在下面,翻车也照实写。

案例一:前端一次成

提示词:

用单个 HTML 文件做一个以「敦煌飞天」为主题的沉浸式数字艺术页,要求:
1. 视觉风格自己定,从敦煌壁画取矿物色(土红、石青、石绿这类),要有洞窟的深邃和飞天的飘逸
2. 至少两处动效:一处跟随鼠标交互(比如飘带跟随或流沙),一处自动循环(比如飞天巡游或藻井旋转)
3. 页面上的文案全部由你原创,要有意境,禁止占位文本
4. 不用任何外部图片、字体和框架,纯 HTML/CSS/JS/Canvas
5. 代码最后用注释写一句话设计思路
Article image

十三分钟五秒就做完了,咱们来看看效果:

实话讲效果很惊艳,以我十多年的开发经验,同等完整度的页面人工开发至少要一周,而模型不到一刻钟就输出完毕。

至于具体好不好,我先不急着下结论,我们让它自己来总结,以子之矛,攻子之盾。

案例二:视频理解,让它评价自己的作品

思路:把案例一的敦煌飞天页面录屏30秒,直接喂回给它,让它给自己打分、挑毛病。它说的和我眼里看到的,是不是一回事,有没有自知之明,对比着看。

提示词:

这段视频是一个「敦煌飞天」主题网页的录屏,这个页面就是你自己生成的。看完视频回答:
1. 描述你看到的视觉元素和动效:配色、飘带、落花、光线分别是什么样的
2. 视频第 3 秒左右,画面左下角的文案是什么?逐字念出来
3. 给这个页面的审美、动效、文案分别打分(0-100),各配一句理由
4. 以挑剔的前端评审身份,指出至少 3 个不足或能做得更好的地方
5. 说实话:如果这是别的模型做的页面,你会夸它吗?

第 2 题是防幻觉细节题,它连自己作品上的字都念不对的话,就很说明问题了。

Article image

这是它对自己作品的评价,还算中肯。

概念与文案上乘、矿物配色和洞窟氛围做得漂亮,但光标、飘带物理、可访问性等收尾细节没打磨完,是一个 90 分的 Demo,还差最后 10% 的专业成色。

分数准不准另说,它能一口气点出光标、飘带物理、可访问性这三个专业维度,说明它知道好作品该长什么样,这比 90 分本身更值钱。

写在最后

这次发布得看两层。

表层是一个狠角色上市:智能指数追平 Opus 4.8,价格 1/40。

里层是成本被重新定义:激活 18B 打出准旗舰水准,价格能打到 1/40 不是烧钱补贴,是真把成本降下来了。

要不要换成你的主力模型?我的答案是分任务切,别全切:批量自动化、后端杂活、文档办公这些高频活,尽管切过去;极限难度的长程任务先留着。

还有一层风险要认:匿名测试一周就产生了巨大调用量,正式对外开放之后,智谱的算力能否承接住流量,是一个现实风险点。

上面两个实测案例就是我的判断依据,行或者不行,摆数据说话。

文末福利:三个入口,从免费到省钱

1. 免费体验卡,白嫖首选

GLM Coding Plan 每天限量 1 万张体验卡,免费领,领了在 ZCode 里就能直接用 GLM-5.3-Flash 干编码活。入口: https://bigmodel.cn/activity/trial-card/PU9MTWG0PM, 每天限量,领完只能等第二天,想试的趁早。

Article image

2. 下载 ZCode,领 3 亿 tokens

ZCode 是智谱的编程 Agent,写代码、跑任务都能用,下载就送 3 亿 tokens,入口:zcode.z.ai,GLM-5.3-Flash 直接调用。注意单位,是"亿",别人送 tokens 按万计,智谱按亿起送。

Article image

3. 限时价格,9 月 9 日 24 点截止

限时价输入 0.4 元/M、输出 1.4 元/M、缓存输入 0.115 元/M(API 从 BigModel 开放平台走),之后恢复 0.8 和 2.8。

Article image

领完福利,尝试完这个模型,不妨回来留言说一说你自己的体验。

好了,关于“牛来”大模型的一手测评,我们就分享到这里。

我是程序员小灰,我会持续为大家分享最新的AI工具和AI玩法,敬请期待~~