中国AI模型正在进一步逼近美国头部产品。最新数据显示,中美顶级AI模型之间的性能差距已经缩小至约3%,创下新低。DeepSeek上个月推出的新模型,在部分测试中的表现已经接近Anthropic和OpenAI的顶级系统,也让外界重新讨论美国AI技术优势还能维持多久。
彭博行业研究高级分析师Robert Lea在5日发布的报告中表示,DeepSeek推出V4.1 Flash之后,中国最强AI模型与美国竞争对手之间的基准测试差距已经缩小到3%左右。
这个速度值得关注。今年年初,双方差距约为15%,到了5月已经缩小到9%,如今进一步降至3%。Lea预计,随着模型能力继续提升,中国AI公司的市场份额还会扩大。
在AI模型评测平台LiveBench上,DeepSeek V4.1 Flash排名全球第六。这是DeepSeek去年凭借推理模型R1受到广泛关注以来,中国模型取得的最高排名。
LiveBench主要通过问答、逻辑题以及不同实际任务,综合评估模型的回答、分析和推理能力。
具体来看,DeepSeek最新得分为81.1分,Anthropic最强模型为83.4分,差距已经不大。Lea认为,DeepSeek目前展现出的整体性能已经可以与Anthropic和OpenAI的头部模型相提并论。
不过,这并不意味着中国模型已经整体追平美国。在LiveBench全球前15名中,目前只有3款中国模型,因此美国厂商在顶级模型数量和整体阵容上仍然占据优势。
分析认为,中国AI研究能力不断提升,同时模型开发者越来越擅长针对国产芯片进行优化。
与此同时,Anthropic和OpenAI正在为潜在IPO争取万亿美元级估值,领先的模型性能是支撑这些估值的重要理由之一。但中国模型正在用另一个办法抢市场,也就是低价。
不过,模型跑分接近,并不等于商业能力也已经接近。
Lea提醒,模型排行榜随时可能发生变化,而且无论排名多高,AI公司最终都要面对盈利问题。
从整个行业来看,中国AI企业到2030年前可能仍然很难摆脱持续亏损。
目前中国市场已经涌现超过1100个大语言模型,大量厂商同时竞争,Token价格不断下降。低毛利和激烈价格战使任何一家公司都很难快速建立长期稳定的商业优势。
在AI应用商业化方面,字节跳动旗下豆包目前处于领先位置,而DeepSeek和腾讯部分聊天机器人仍然免费提供服务。
Lea认为,中国AI产业如果要建立可持续的收入结构,需要降低过度竞争,进行行业整合,同时让模型服务定价更加合理。
有意思的是,美国企业同样开始越来越重视低成本模型。
研究平台AlphaSense数据显示,今年8月和9月,美国企业财报电话会和投资者会议中提到“开放权重”或“开源”模型的次数,已经达到去年同期的6倍。
越来越多企业正在采用“混合模型”策略:真正复杂、关键的任务使用昂贵的顶级模型,日常简单工作则交给价格更低的开放模型。
DeepSeek近期推出的V4 Pro就是这一趋势的典型案例。该模型在SWE-bench Verified软件工程测试中取得80.6%的头部成绩,而据报道,其综合Token价格只有Anthropic Claude Opus 4.7的大约1/46。
这种巨大的成本差距,正在迫使企业重新考虑一个现实问题:是不是每一个任务,都真的需要调用最贵、最强的模型。
更新时间:2026-10-07
本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828
© CopyRight All Rights Reserved.
Powered By 61893.com 闽ICP备11008920号
闽公网安备35020302034903号