
阿里巴巴发布了其最新旗舰大语言模型Qwen3.8,并声称这是目前最强大的模型之一。
具体而言,该公司在周日的发布公告中称,Qwen3.8"仅次于Fable 5",即Anthropic备受瞩目的旗舰模型。然而,阿里巴巴既未提供模型卡,也未给出任何基准测试数据或其他有价值的信息。
值得注意的是,此次发布恰好是在竞争对手——中国AI公司月之暗面推出Kimi K3后数日内。Kimi K3在Arena编程排行榜上登顶,并在内部基准测试中与Anthropic和OpenAI旗下的系统相抗衡,同时获得BBC、彭博社等主流媒体的广泛报道。
尽管月之暗面尚未公布K3的模型权重,但已发布了相当详实的技术说明文档,包含与其他主流系统的完整基准对比表、架构细节以及定价信息,并将开放权重的日期定在7月27日。
相比之下,阿里巴巴在很大程度上仅凭一条X平台发帖就发出了这一大胆声明。此外,该帖子还出现了若干语法错误,其中一处将"兼容"(compatible)与"可比"(comparable)明显混淆。虽然这并非致命问题,但对于一款意图跻身前沿竞争的模型来说,这类细节难免令人对此次发布缺乏信心。
开放权重AI的整体市场需求在今年快速增长。分析师和基础设施供应商认为,开放模型与闭源前沿模型之间的差距已缩短至约四个月,且成本仅为后者的一小部分。
这种价格差距正在改变企业采购AI的方式。今年6月,The New Stack报道称,AI智能体初创公司Lindy正将全部生产流量从Anthropic模型迁移至DeepSeek v4,其CEO表示此举将为公司节省数百万美元。供应商锁定也成为日益突出的隐患,业界许多人士警告过度依赖单一专有模型栈的风险。
Qwen在这一趋势中受益颇丰。基础设施提供商Runpod的平台数据显示,Qwen已超越Meta的Llama,成为其用户中部署量最大的开放权重大语言模型。
然而,尽管Qwen凭借高产的开放权重发布建立起了良好声誉,其最近两款旗舰模型却打破了这一惯例。今年4月发布的Qwen3.6-Max-Preview是Qwen历史上首个仅提供API访问、不公开权重的旗舰模型;5月随后推出的Qwen3.7-Max同样是闭源的,既无本地可运行版本,也未公布相关计划。
此次Qwen3.8发布时,阿里巴巴明确表示将以开放权重形式发布,似乎是在回归初心。但最大的疑问在于:何时发布?以及这次发布的时机究竟是出于对开放性的承诺,还是针对某个特定竞争对手的战略考量?
私募股权公司Fortino Capital的AI运营合伙人、前Hugging Face和AWS AI布道者朱利安·西蒙(Julien Simon)认为,真正的关键在于他所说的"检查点空缺"——即从前沿声明发出到任何人都能验证的实际产物出现之间的时间窗口。
"Kimi K3发布时的每一项主张都可以按日历逐条核验。"
西蒙在周日发表的The AI Realist新闻通讯中指出,Kimi K3的空缺期"激进但有章可循":有基准测试表、公开的定价,以及7月27日这一明确的权重发布日期。
"那次发布中的每一项声明,都可以与日历逐条对照核验,"他写道。
相比之下,Qwen3.8同样存在这样的空缺期,却缺乏任何约束:没有基准表,没有定价,没有日期——只有一句含糊的"即将开放权重"。一个没有截止日期的空缺期,实际上是供应商可以随时行使的选项,同时又能持续"收割开放权重的叙事红利"。
这两款模型背后,其实都与同一家公司有所关联。截至2024年,阿里巴巴是月之暗面的最大股东,已累计投入约8亿美元,当时持股比例约为36%——此后随着月之暗面融资规模和估值的持续攀升,该持股比例可能已有所稀释。
据报道,仅Kimi K3的发布就导致全球半导体市值在数日内蒸发逾3万亿美元。而就在数日之后,阿里巴巴发布了一款参数规模略小的模型(2.4万亿 vs 2.8万亿),声称排名略高,并同样打上了"开放权重"的标签——却缺少关键细节。
"从文字到数据之间的空缺越长,说明发布本身才是真正的产品。"
眼前一个显而易见的问题是:一家公司为何要与自己的被投企业竞争?西蒙的解释归结于:一张真正的基准测试表,将迫使阿里巴巴披露不愿公开的信息。他认为,若数字足够亮眼、能够超越Kimi K3,则会让阿里巴巴持有的月之暗面股权显得不如押注自家模型合算——而此时月之暗面正规划上市。若数字不及预期,则直接让"仅次于Fable 5"的定位站不住脚。两头都不表态,反而成了最优解——Qwen得以在媒体头条和企业对话中抢占位置,同时又无需与K3并排接受检验。
"从文字到数据之间的空缺越长,说明发布本身才是真正的产品,"西蒙写道。
简而言之,这次公告从一开始就不是真正关于模型本身的,更多是为了借势一个备受瞩目的竞争对手,将自己插入话题中心。
"对于一个2.4万亿参数的模型来说,缺失架构细节至关重要。"
目前已出现一些对Qwen3.8进行独立基准测试的早期尝试。其中一项于周日发布,由Trilogy公司AI卓越中心副总裁莱昂纳多·冈萨雷斯(Leonardo Gonzalez)在相同任务上将托管预览版与Kimi K3进行了对比。但这仅是一次测试,由单一评审者评分,测试对象是阿里巴巴自称在正式发布前仍会持续变更的预览版本,远不能替代阿里巴巴迄今尚未发布的正式基准测试表。
"对于一个2.4万亿参数的模型来说,缺失架构细节至关重要,"冈萨雷斯坦言。
目前,Qwen3.8仍停留在最初的状态:一个对标Anthropic的漂亮标题,仅此而已。
Q&A
Q1:Qwen3.8和Kimi K3在发布方式上有什么不同?
A:Kimi K3发布时附有完整的基准测试表、公开定价和明确的权重发布日期(7月27日),信息透明可供核查。而Qwen3.8的发布则缺乏上述关键信息,仅在X平台发帖声称性能"仅次于Fable 5",未提供基准数据、定价或具体发布时间,可信度存疑。
Q2:阿里巴巴既投资月之暗面,又发布Qwen3.8与之竞争,原因是什么?
A:分析人士认为,阿里巴巴选择不公开详细基准数据,可能是为了规避两难局面:若Qwen3.8数据优于Kimi K3,会令自身对月之暗面的投资显得不明智;若数据不如Kimi K3,则会直接否定其"仅次于Fable 5"的声明。因此,含糊其辞反而是最安全的策略。
Q3:Qwen系列模型在开放权重方面有什么历史?
A:Qwen此前以高频发布开放权重模型著称,一度超越Meta的Llama成为Runpod平台上部署量最大的开放权重大语言模型。但近两款旗舰产品——Qwen3.6-Max-Preview和Qwen3.7-Max均为闭源,仅提供API访问。Qwen3.8宣称将恢复开放权重,但未给出具体日期。
更新时间:2026-07-30
本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828
© CopyRight All Rights Reserved.
Powered By 71396.com 闽ICP备11008920号
闽公网安备35020302034903号