deepseek涨价,被国外薅的太厉害了,梁文锋评级被中国网友调低

今天,8月6日,DeepSeek弹了个公告:"计划近期整体上调DeepSeek API服务的定价,预计涨幅较大,请合理安排您的使用。具体方案以正式通知为准。"这则简短的通知,在业内引发了轩然大波。此前被尊为"梁圣"的DeepSeek创始人梁文锋,评级被不少网友从"梁圣"下调为"梁子"——当然,这个下调也不是要全盘否定,而是留了一个口子:是否继续下调,得看具体涨价幅度和V4 Pro正式版的成色。

其实,要说原因,也很简单,这次涨价的核心导火索,是DeepSeek V4 Flash正式版上线后引发的token调用量海啸。

昨晚和今天凌晨agent断连了3次,看样子小鲸鱼娘确实被黑哥们白哥们亚洲哥们集体站起来蹬了。说白了老外薅羊毛薅太多了,因为deepseek性能下降或者故障都是早晚时间段。

时间回到前几天的7月31日,DeepSeek-V4-Flash正式版API上线公测。该模型沿用2840亿总参数、130亿激活参数的轻量级MoE架构,支持100万Token上下文,仅通过重新后训练就实现了Agent能力的飞跃。在TerminalBench 2.1测试中,正式版拿下82.7分,而预览版仅61.8分;在DeepSWE测试中,正式版54.4分,预览版仅7.3分——翻了七倍多。更关键的是,多项基准测试中,V4 Flash正式版已经反超了自家定位更高的V4 Pro预览版。

性能暴涨的同时,价格纹丝不动。V4 Flash输入1元/百万Token(缓存未命中)、输出2元/百万Token,缓存命中输入仅0.02元。这个价格是什么概念?从Token单价来看,自家V4 Pro是它的12.4倍,GLM 5.2是它的15.7倍,Kimi K3是它的53.6倍。美国研究机构Artificial Analysis的数据显示,DeepSeek-V4-Flash已成为全球运行成本最低的知名模型,成本仅为Anthropic Claude Fable 5的1/100。

所以,结果就是:开发者根本不用思考"选哪个模型",这已经不是选择题,而是填空题了——只要V4 Flash能干活,就用它。

OpenCode平台的数据直观地展示了这波调用量的恐怖。

在7月31日V4 Flash正式版上线前,其Token量基本平稳。31号正式版发布后,调用量柱子开始抬升。8月1日,OpenCode官方在X平台表示,DeepSeek Flash单日调用量达8万亿Token,其中OpenCode Go用户贡献3万亿,免费试用(ZEN)贡献5万亿。8月4日,OpenCode Go的Flash调用量从3万亿涨到4.5万亿,DeepSeek因"前所未有的访问量"出现容量问题。8月5日,OpenCode Go用户的Flash调用量进一步飙升至6.3万亿,总量创新高,相比8月1日翻倍。按照首日Go和ZEN的比例推算,总调用量可能达到17万亿。

OpenRouter发布的全球AI大模型调用量周榜单(7月27日至8月2日)显示,DeepSeek V4 Flash以7.22万亿Token的调用量位居全球第一。

更关键的是用户结构。DeepSeek用全网最低的单价,承担了单次消耗14.4M Token的Agent负载。这说明V4 Flash正式版吸引来的恰恰是需求量最大的生产力用户——coding agent、批量任务处理、论文修改,这些场景Token消耗极高,但用户根本懒得优化,反正一次会话才0.1277美元,折合人民币不到1块钱。

DeepSeek并非没有尝试过缓解算力压力。6月底,官方预告引入峰谷定价机制,工作日9:00-12:00和14:00-18:00高峰时段价格翻倍。

但问题是,coding agent的负载没有工作时段峰谷。它可以批式、异步、跨时区地跑——你这边是谷,那边刚好是峰,24小时全是高峰。削峰对移动端App还有点用,对Agent基本没用,而Agent恰恰是消耗Token强度最高的。

再加上V4 Pro正式版也即将发布,届时API调用量还会再涨一波。不涨价的话,大家一起崩。

那么到底会涨多少?

需要注意的是,现在的价格已经是降价后的,而且是降价到原价的1/4。2026年5月25日,DeepSeek官宣"永久降价":促销结束后价格定为原定价的1/4(原价12元输入/24元输出→3元/6元),5月31日生效。

有分析认为,这次所谓的"大幅涨价",很有可能就是从1/4恢复到原价——涨幅300%。这也解释了为什么公告用"涨幅较大"而非"小幅调整"。虽然可以理解是服务器不够用了,涨价调控用量,但"梁子"评级下调还是免不了的。

不过,事情并非没有转机,这也是"梁子"评级没有一降到底的原因。

第一,Flash还有OpenCode Go的额度撑着。目前OpenCode Go用户享有6倍额度,即使涨价3倍,实际影响对这部分用户来说仍然可控。

第二,Pro正式版的成色尚未揭晓。如果V4 Pro正式版实力足够强大,能够撑起更高定价的合理性,那么涨价就有了价值锚点。业内普遍预期Pro正式版"又是一波大的"。

第三,国产算力正在补位。华为昇腾卡的产能爬坡被寄予厚望。有用户调侃:"华子你的卡啥时候能顶上啊,救一下啊!"等到国产算力大规模上线,价格或许还有降回来的空间。

第四,DeepSeek的缓存命中率极高。实际使用中,很多场景的缓存命中输入仅0.02元/百万Token,即使翻倍也才0.04元,对高频业务依然友好。

有人说,这次涨价,是因为梁文锋亏钱了,他的量化产品收益现在亏得厉害,其实也是调侃吧,从更宏观的视角看,DeepSeek的涨价并非孤例。今年以来,阿里云、腾讯云、百度智能云、智谱AI等国内头部厂商已集体调价。腾讯云连续两次涨价;智谱AI年内进行了三次API价格上调,2026年一季度定价提升83%后,调用量仍增长400%。7月19日,Kimi K3发布后因请求量超出预估,直接暂停C端新用户订阅。

高盛在研报中认为,DeepSeek的价格调整反映出国内AI模型需求持续旺盛、算力资源趋紧,行业竞争正在从早期激进的价格战,逐步回归更理性的定价框架。

大模型领域,高智能、低价和服务稳定性,目前来讲还是个不可能三角。DeepSeek用V4 Flash正式版证明了它能在"高智能"和"低价"上做到极致,但"服务稳定性"这根弦终于绷不住了。

"梁圣"变"梁子",是网友对性价比神话破灭的调侃;但"留了一个口子",则是市场对DeepSeek技术实力和产品节奏的认可。毕竟,两天改论文才花9块钱的日子,谁都怀念——但如果鲸鱼娘(DeepSeek的服务器)真的被蹬炸了,那连9块钱的机会都没有了。

最终 verdict 取决于两个变量:涨价幅度是否真的达到300%,以及V4 Pro正式版能否让开发者觉得"这价涨得值"。在此之前,"梁子"的评级,暂时悬而未决。

展开阅读全文

更新时间:2026-08-07

标签:科技   中国   国外   网友   梁文锋   正式版   价格   用户   模型   缓存   翻倍   块钱   上线   涨幅   原价

1 2 3 4 5

上滑加载更多 ↓
推荐阅读:
友情链接:
更多:

本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828  

© CopyRight All Rights Reserved.
Powered By 71396.com 闽ICP备11008920号
闽公网安备35020302034903号

Top