

8月13日,DeepSeek宣布将对DeepSeek API价格进行更新调整,采用峰谷定价,空闲时段价格为高峰时段价格的一半。高峰时段为北京时间9:00-12:00、14:00-18:00(其余为空闲时段)。新价格将于北京时间2026年8月17日00:00开始生效,具体如下:

截图自DeepSeek官网。
早前,8月6日消息,DeepSeek曾在官方API文档中加上一句预告:计划近期整体上调API服务定价,“预计涨幅较大”,具体方案另行通知。
据了解,这是2026年以来DeepSeek第四次发布定价调整通知。
2026年4月25日,DeepSeek下调缓存命中输入价格,DeepSeek-V4-Pro模型API开启限时2.5折优惠活动,优惠期至2026年5月5日。优惠后,百万tokens输入价格(缓存命中)为0.25元,百万tokens输入价格(缓存未命中)为3元,百万tokens输出价格为6元。
5月22日晚间,DeepSeek宣布模型API价格将于5月31日结束2.5折优惠活动后,正式调整为原定价的四分之一。调价后,输入缓存命中0.025元/百万tokens、未命中缓存3元/百万tokens、输出6元/百万tokens,相较原价实现75%的降幅。
6月底,DeepSeek V4正式版计划于7月中旬正式上线,预计本次版本更新将带来更多功能优化和性能提升。为更合理地配置资源、提升服务稳定性,正式版发布后将同步调整API定价策略,引入峰谷定价机制,高峰时段调用价格直接翻倍。
当时,有分析人士认为,DeepSeek V4正式版峰谷定价并非单纯涨价,而是算力资源稀缺背景下的标准化调度工具。
此外,2025年2月26日,DeepSeek在其API开放平台发布错峰优惠活动通知。北京时间每日00:30—08:30为错峰时段,API调用价格大幅下调,其中DeepSeek-V3降至原价的50%,DeepSeek-R1降至25%。
算力成本压力可能是DeepSeek涨价的主要原因。有消息称,8月1日DeepSeek V4-Flash在其平台单日处理Token总量达8万亿。目前,DeepSeek调用量稳居全球行业榜首。
最近,DeepSeek被传启动第二轮融资,计划融资500亿元,投前估值5000亿元。2026年4月,公司完成首轮融资500亿元,创始人梁文锋出资200亿元。
有报道称,2026年7月,梁文锋旗下的量化投资,多只产品年内收益转负。
此外,8月12日消息,“DeepSeek Harness团队”微信公众号近日已完成注册。该公众号Logo为一只黑色鲸鱼,认证主体为北京深度求索人工智能基础技术研究有限公司,IP属地为北京海淀,账号目前暂未对外发布任何内容。
8月13日,DeepSeek Harness的开发者预览版(v0.1版本)面向全球Harness开发者开放测试,并同步以MIT协议开放源代码。DeepSeek Harness采取“一切皆插件”的设计思路,模型、工具、技能、会话、沙箱、存储、循环、调度、UI等所有Agent能力均由插件组合而成,可自由替换、灵活重组。
这是DeepSeek首次为Harness业务线单独设立官方发布阵地。独立于主公众号运营,表明团队希望为这项新业务建立一个专属的信息发布、产品动态和技术分享的平台。此举也被外界解读为Harness产品即将正式发布。
Harness在DeepSeek内部被定义为智能体的执行框架,它是围绕大模型构建的一套完整控制与编排系统,负责调度工具、管理任务状态和执行闭环,旨在将模型的推理能力转化为能实际完成复杂任务的智能体。
在官方招聘信息中,DeepSeek给出了“Model+Harness=Agent”的公式,并表示:“我们正在把DeepSeek的前沿模型能力,转化为领先的Agent产品。这其中除模型本身以外的所有工作,都属于Harness的范畴。”
简单来讲,DeepSeek基座大模型相当于智能体的“大脑”,负责推理、理解需求、生成代码;而Harness就是整套智能体的“执行神经系统”,承担大脑与真实环境之间的衔接工作。大模型只能输出文本结果,Harness让AI真正具备动手执行的能力,这也是它和普通对话大模型最本质的区别。
今年5月,DeepSeek资深研究员陈德里确认,公司内部正在组建Agent Harness团队,目标是从零开始做DeepSeek Code Harness,对标Anthropic旗下的Claude Code。DeepSeek还在招聘平台放出相关岗位招聘,工作地点均设置在北京。
DeepSeek入局智能体赛道,手里已经握着可观的开发者基本盘。第三方模型聚合平台OpenRouter统计数据显示,7月27日至8月2日,DeepSeek V4 Flash以7.22万亿Token的成绩位居全球AI大模型调用量周榜单第一。大量海外开发者正在基于DeepSeek基座做二次开发。
不过,代码智能体对系统稳定性、安全边界控制要求极高。智能体拥有操作文件、执行命令的权限,一旦出现越界行为,会带来代码篡改、系统误操作等风险,安全护栏的搭建工作量巨大。
除此之外,智能体产品还需要完善文档、开发者生态、技术支持体系,整套生态建设需要时间沉淀。有技术人士表示,基座模型强不等于智能体产品就强,执行框架、提示工程、错误回滚机制,每一环短板都会让Agent在真实场景失灵。
■综合自Deepseek官网、界面新闻、长江商报、每日经济新闻
■编辑:越玥、张阿嫱
更新时间:2026-08-15
本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828
© CopyRight All Rights Reserved.
Powered By 61893.com 闽ICP备11008920号
闽公网安备35020302034903号