全球火了一周的顶流AI,谜底揭晓:国产的,还跑在国产卡上
全世界开发者用了一周的神秘顶流不是 OpenAI 也不是谷歌——今天智谱认领了那是我家的GLM-5.3-Flash而且整条线上服务全部跑在国产芯片上。过去这一周全世界 AI 圈最热的事不是 OpenAI 出了新模型也不是谷歌憋了大招。是一个连名字都没有的隐身模型。它在 8 月 20 号深夜悄悄挂上全球最大的模型平台 OpenRouter免费开放、自带超长上下文、还能看图看视频。第一天调用量就冲到全球第一顺手终结了 DeepSeek 在另一个平台霸了56 天的榜首——光一天就吃掉62T token。开发者们彻底疯了这是谁OpenAI 的马甲还是哪家硅谷巨头在偷偷练级直到今天智谱站了出来把牛领回了家——是我家的GLM-5.3-Flash。而且真正让行业倒吸一口冷气的是另一句话这模型整条线上服务跑的全是国产芯片。大家以为的 vs 实际发生的在多数人的想象里全球 AI 的顶流应该是这样的剧本要么是 OpenAI、Anthropic 这些闭源巨头的新旗舰要么是英伟达卡堆出来的钞能力选手。至于国产模型再强也得让人家英伟达的显卡来背着跑。这一周发生的事把这个剧本撕了个口子全球开发者自发抢着用的顶流模型是国产开源模型——匿名还跑在国产显卡上它在全球调用量榜上登顶时中国模型包揽了前三名全球份额超过六成它跑出了能看的性能价格却只有顶级闭源模型的四十分之一。你以为是国外新贵碾压国产结果是国产新贵登顶了全世界还顺手换了算力。这场猜谜游戏是怎么火的先把时间线捋清楚你就知道它多离谱。8 月 20 号OpenRouter 上冒出一个叫stealth/ox-alpha的匿名条目啥介绍都没有免费、100 万上下文、图文视频全能。海外开发者第一反应是会不会是钓鱼。结果一试真香。首日调用量直接登顶 OpenRouter 历史纪录还终结了 DeepSeek 在 OpenCode 上长达 56 天的榜首——单日 62T token。一周下来它创下两大平台的历史调用新高成了当周全球最火模型光周调用量就有17.5 万亿 token。接下来的剧本比模型本身还有意思全网开始猜是谁。有人说是 OpenAI 的新作有人猜是某家被收购团队的遗作。中文开发者给它起名——“牛来”。现在谜底揭晓了Ox Alpha 智谱 GLM-5.3-Flash320B 参数、每个 token 只激活 18B 的 MoE 架构GLM 系列第一个原生多模态基座MIT 协议直接开源。为什么一个马甲能让全球疯抢抛开热闹这三件事才是它真正能登顶的硬原因。第一能力够顶。在独立评测平台 Artificial Analysis 的榜单上它和 Claude Opus 4.8 分数相等——那可是 Anthropic 的旗舰。多模态、运维上下文、写代码全都能打。开发者不是看它便宜才用是又便宜又能打才用。第二价格打到闭源巨头不敢跟。每百万 token输入 0.8 元、输出 2.8 元、缓存命中只要 0.23 元。对比起来约为 Claude Opus 4.8 的1/40。第三也是最关键的一条——它跑在国产卡上。智谱说匿名测试和发布后的全部线上流量由一整套超过 10 万张的国产芯片集群承载。供应商没点名但行业信息指向华为昇腾、海光、摩尔线程。智谱的文档里有一句原话硬件效率和单 token 成本已经达到与主流英伟达 GPU 相当的水平。这句话才是真正的王炸。SemiAnalysis 的分析也点了名“CUDA 护城河再度受到考验。”模型可以是匿名的算力藏不住——10 万张国产卡才是这次真正的底牌。这只是性能问题吗不是顺序问题以前我们说国产模型追平闭源指的是用户量、能力追上了。这次不一样的是顺序反过来了过去是用好模型必须靠英伟达显卡现在是模型登顶全球算力底座却是自己人的卡。智谱在那么多国产平台里选了这一步背后是很实际的一次验证国产大模型已经可以不靠海外 GPU独立扛起全球真实的生产级流量了。这不是一次测试是连续一周、每天几十 T token 的真金白银投入跑出来的。顺带一个值得记住的画面8/24 的 OpenRouter 实时榜上全球调用量前三名全是中国的模型——第一名是它第二名是 DeepSeek第三名还是国产。对我们意味着什么对开发者 / 创业者这是实打实的降本你能用接近顶级闭源的能力只花 1/40 的钱还是开源、能私有化部署的。做应用、做 Agent算力账本直接改写。对普通用户最直接的是便宜的多模态模型大量出现看图、看视频、写文档这些能力会更快来到你手上的产品里。以后你觉得某个 AI 应用变便宜了背后很可能是国产模型 国产算力在托底。对关心国产技术的人来说这是一个明确的信号便宜 开源 自研算力三条腿都站住了。以后国产模型强不再只是嘴上说是有全球真实流量和国产芯片底座兜着的。下次再听到国产 AI 不如别人可以拿这一周的事回一句全球最火的 AI这一周就是国产的还跑在国产卡上。以前我们说国产模型追平了闭源这次是国产显卡先追平了——顺序反过来才是真的不一样。结语这一周全球开发者用脚投票给国产 AI 到底行不行交了一份最真实的答卷。它不是靠一个惊艳的发布会而是靠连续七天、几十 T token 的真实流量让全世界开发者自己真香出来的。模型可能是匿名的但这台模型跑在谁的卡上——这次答案写在国产芯片的账本里。

相关新闻