靠 10 万张国产芯片,这款 AI 模型成本仅 1/10,6 天登顶全球榜单

8 月 20 日,一款匿名上线的 AI 模型突然刷爆全球 AI 聚合平台 OpenRouter,短短 6 天就拿下热门榜第一,打破了此前 Deepseek 的霸榜记录。没人想到,这款代号 Ox‑Alpha 的神秘模型,竟然来自中国智谱 AI。

匿名盲测 6 天登顶,国产 AI 模型藏了什么大招?

Open Router 是全球最大的 AI 模型聚合平台,用户无需额外注册绑定即可体验多款模型。这款 Ox‑Alpha 上线后迅速登顶,6 天 Token 使用量达 23.2T,是 Deepseek 的两倍。

直到8 月 26 日,智谱 AI 才正式官宣,这就是他们的 GLM 5.3 Flash,是 5.3 版本的精进版。为了保证测试公平,智谱选择匿名上线,避免用户先入为主,完全靠性能说话。这款模型还被网友戏称为 “牛来”,因谐音好记迅速出圈。

不靠英伟达,10 万张国产芯片撑起顶级算力

美国此前多次限制对华出口高端 GPU,断言 “没有英伟达芯片,中国无法做出顶级大模型”。而智谱 GLM 5.3 Flash 的匿名公测,对该论断形成有力冲击。

据多家行业媒体消息,本次公测全部线上推理流量,由超过 10 万张国产 AI 芯片组成的集群承载,算力供应商包括华为昇腾、海光、摩尔线程等国内厂商。

经过大量底层调度优化,硬件推理单 Token 内部成本约为同等规模英伟达 GPU 方案的 1/10;对外 API 定价,约为 Claude Opus 4.8 的 1/40,这也是它最核心的竞争力。

性能对标国际旗舰,国产 AI 迎来新突破

在 Artificial Analysis 权威评测榜单中,GLM 5.3 Flash 得分 57 分,性能对标 Anthropic 的 Claude 3 Opus。对比硬件初始基线,端到端服务性能提升 3 倍(硬件调度优化层面),硬件效率已经接近主流英伟达 GPU 方案。

同时它原生支持文字、图片、视频多模态处理,应用场景广泛。 更关键的是,它采用了高效的计算调度技术,能在百万级 Token 长上下文测试中实现最优算力分配,大幅降低能耗和成本。

这次大规模真实业务全部跑在国产算力之上,打破美国 “无英伟达 GPU 无法做大模型” 的片面断言,中国大模型跻身全球第一梯队。

这款国产大模型的爆火,代表国产算力在大模型推理场景完成一次大规模实战验证,国内大模型不再只依赖海外高端 GPU 这一条路线。未来随着技术持续成熟,它将进一步挑战海外 AI 巨头的市场地位,给全球 AI 行业带来新变量。

展开阅读全文

更新时间:2026-09-09

标签:科技   芯片   模型   成本   全球   英伟   性能   硬件   上线   断言   美国   中国

1 2 3 4 5

上滑加载更多 ↓
推荐阅读:
友情链接:
更多:

本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828  

© CopyRight All Rights Reserved.
Powered By 71396.com 闽ICP备11008920号
闽公网安备35020302034903号

Top