8 月 20 日,一款匿名上线的 AI 模型突然刷爆全球 AI 聚合平台 OpenRouter,短短 6 天就拿下热门榜第一,打破了此前 Deepseek 的霸榜记录。没人想到,这款代号 Ox‑Alpha 的神秘模型,竟然来自中国智谱 AI。

Open Router 是全球最大的 AI 模型聚合平台,用户无需额外注册绑定即可体验多款模型。这款 Ox‑Alpha 上线后迅速登顶,6 天 Token 使用量达 23.2T,是 Deepseek 的两倍。
直到8 月 26 日,智谱 AI 才正式官宣,这就是他们的 GLM 5.3 Flash,是 5.3 版本的精进版。为了保证测试公平,智谱选择匿名上线,避免用户先入为主,完全靠性能说话。这款模型还被网友戏称为 “牛来”,因谐音好记迅速出圈。

美国此前多次限制对华出口高端 GPU,断言 “没有英伟达芯片,中国无法做出顶级大模型”。而智谱 GLM 5.3 Flash 的匿名公测,对该论断形成有力冲击。
据多家行业媒体消息,本次公测全部线上推理流量,由超过 10 万张国产 AI 芯片组成的集群承载,算力供应商包括华为昇腾、海光、摩尔线程等国内厂商。
经过大量底层调度优化,硬件推理单 Token 内部成本约为同等规模英伟达 GPU 方案的 1/10;对外 API 定价,约为 Claude Opus 4.8 的 1/40,这也是它最核心的竞争力。

在 Artificial Analysis 权威评测榜单中,GLM 5.3 Flash 得分 57 分,性能对标 Anthropic 的 Claude 3 Opus。对比硬件初始基线,端到端服务性能提升 3 倍(硬件调度优化层面),硬件效率已经接近主流英伟达 GPU 方案。
同时它原生支持文字、图片、视频多模态处理,应用场景广泛。 更关键的是,它采用了高效的计算调度技术,能在百万级 Token 长上下文测试中实现最优算力分配,大幅降低能耗和成本。

这次大规模真实业务全部跑在国产算力之上,打破美国 “无英伟达 GPU 无法做大模型” 的片面断言,中国大模型跻身全球第一梯队。
这款国产大模型的爆火,代表国产算力在大模型推理场景完成一次大规模实战验证,国内大模型不再只依赖海外高端 GPU 这一条路线。未来随着技术持续成熟,它将进一步挑战海外 AI 巨头的市场地位,给全球 AI 行业带来新变量。
更新时间:2026-09-09
本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828
© CopyRight All Rights Reserved.
Powered By 71396.com 闽ICP备11008920号
闽公网安备35020302034903号