您的位置: 首页 > 推荐

DeepSeek举起涨价牌

出处:北京商报 作者: 魏蔚 网编:王巍 2026-08-07

“计划近期整体上调DeepSeek API(应用程序编程接口)服务的定价,预计涨幅较大。”8月6日,DeepSeek开放平台弹出的一行提示,在AI从业者群体中引发热议。如同科技股的行情波动,大模型API价格的起落,比行业预想来得更快。

回看DeepSeek,这家曾以“价格屠夫”姿态搅动市场的企业,近三个月内多次调整定价机制。5月,DeepSeek保留DeepSeek V4-Pro的2.5折优惠;6月预告DeepSeek V4正式版上线时间,并公布API峰谷定价方案。放眼整个国产大模型赛道,涨价已不是个例,以智谱为例,2026年一季度其API价格上涨83%。相较其他国产大模型,DeepSeek的API长期处于低位,如今抛出涨价预告背后有多重行业猜测。可以确定的是,尽管长周期来看Token成本趋势下行,但当下大模型厂商与客户,仍要承受短期价格波动带来的影响。

图片来源:视觉中国

一则调价通知

8月6日,北京商报记者发现,DeepSeek官网API开放平台页面上方出现一行蓝色小字,通告了DeepSeek API近期的价格上调计划。不过该通知仅表示,预计涨幅较大,请合理安排使用,具体方案以正式通知为准。

按照DeepSeek规定,公司根据模型输入和输出的总Token数进行计量计费。扣减费用=Token消耗量×模型单价,对应的费用将直接从充值余额或赠送余额中进行扣减。

目前DeepSeek API仅支持DeepSeek V4-Flash模型,暂不支持DeepSeek V4-Pro模型。这两个模型是DeepSeek V4的预览版本,于4月正式上线并同步开源,DeepSeek V4-Pro的参数为1.6T,DeepSeek V4-Flash的参数为284B。

DeepSeek V4拥有百万字超长上下文,在Agent(智能体)能力、世界知识和推理性能上均实现国内与开源领域的领先。

根据Agentic Coding当时的评测,DeepSeek V4-Pro已达到当时开源模型最佳水平,并在其他Agent相关评测中同样表现优异。4月时,DeepSeek V4已成为DeepSeek内部员工使用的Agentic Coding模型,根据评测反馈使用体验优于Sonnet 4.5,交付质量接近Opus 4.6非思考模式,但仍与Opus 4.6思考模式存在一定差距。

目前,DeepSeek V4-Flash模型的百万Tokens输入(缓存命中)的价格是0.02元,百万Tokens输入(缓存未命中)的价格为1元,百万Tokens输出价格为2元。DeepSeek V4-Pro模型的百万Tokens输入(缓存命中)价格是0.025元,百万Tokens输入(缓存未命中)价格为3元,百万Tokens输出价格是6元。

也就是说,参数更小的DeepSeek V4-Flash百万Tokens输入(缓存未命中)价格是大参数DeepSeek V4-Pro的80%,百万Tokens输入(缓存未命中)和百万Tokens输出价格均是DeepSeek V4-Pro的三分之一。

根据通知,DeepSeek V4-Flash正式版API已上线公测,Agent能力大幅增强。DeepSeek API将在8月初支持DeepSeek V4-Pro模型。

涨多少

如果将这则涨价通知放在DeepSeek的定价史上则显得格外刺眼。DeepSeek出圈后,API价格降时多、涨时少。4月,DeepSeek V4预览版上线后几天,公司就对V4-Pro模型开启2.5折限时特惠,并将原本至5月5日的优惠期延至5月31日。还未到优惠截止日,DeepSeek又宣布V4-Pro模型2.5折价格永久化。

这还没有结束,6月底,DeepSeek预告V4正式版并提出峰谷定价机制,高峰时段为每日9—12时和14—18时,在这一时段调用价格翻番。

如今看来,这正是8月7日涨价通知的苗头。

“这是一个标志,DeepSeek之前的价格太低了”,文渊智库创始人王超向北京商报记者分享了自己的猜测,“这次价格应该会成倍以上地上涨,或者起码跟目前国产大模型价格持平。”

按照全球AI模型聚合平台OpenRouter数据,本周调用量前十的国产大模型包括DeepSeek V4-Flash、Hy3、GLM-5.2、DeepSeek V4-Pro、MiniMax M3。

以同为“大模型六小虎”的模型GLM-5.2、MiniMax M3为例,智谱官网显示,上下文1M Token的GLM-5.2百万Tokens输入单价为8元,百万Tokens输出单价为28元,缓存存储限时免费,缓存命中百万Tokens价格为2元。MiniMax M3 API的价格分多个档次,以上下文512K—1M的版本为例,标准版定价更便宜,这款模型的百万Tokens输入价格为4.2元,输出价格是16.8元,缓存读取价是0.84元。

OpenRouter统计的本周调用量前十的模型里,还有7月底刚刚宣布降价的GPT-5.6 Luna。按照OpenAI的通知,在这次GPT-5.6系列模型降价中,GPT-5.6 Luna价格降幅最大,下调80%。调整后,GPT-5.6 Luna百万Tokens输入价格为0.2美元,输出价格是1.2美元。

在王超看来,DeepSeek这次涨价的起因是之前的“价格黑洞”:“它过于特立独行,用户被高性价比吸引到DeepSeek,运行那些最耗资源的应用,导致用户过多,以至于DeepSeek的推理能力跟不上了。”

多面Token

其实,业界对于DeepSeek的低价早有体会,但这个低调的公司从未公开自己的定价逻辑。王超站在算力和生态的角度思考这次涨价:“如果DeepSeek算力不够用,用户体验变差,会影响接入DeepSeek API的云厂商的收入,这样不利于生态扩散。要让部署该模型的云厂商获益,模型的使用体验是前提。更何况DeepSeek本身定价不高,为大模型付费的人都是拿它当作生产力工具,对价格并不敏感。”

仅这半年,因调用量影响模型体验的案例不止一起。7月上旬,Kimi就深夜致歉,称自Kimi K3发布以来,Kimi收获了远超预期的支持,但也面临始料未及的算力挑战。为了保障已有订阅用户的体验,Kimi决定即日起,暂停C端新用户订阅,将已有算力全部投入服务已订阅用户。

长期来看,业内人士从不同角度分享了自己对Token价格走向的判断。

与北京商报记者交流GPT-5.6系列模型降价时,智源研究院院长王仲远认为,“王坚院士希望Token变得像一张纸、一支笔一样廉价,这是有可能的。Token降价基于算力提升、工程和算法优化,以及任务不断分级,简单的任务不再需要复杂的模型。再加上算力芯片的能力提升,价格自然会变得更便宜”。

涂鸦智能联合创始人杨懿从另一个维度给出了判断,他告诉北京商报记者,“Token贵不贵,关键看用得对不对”。

更宏观点看,不论涨跌,围绕Token的讨论不止一面。在Kimi创始人兼CEO杨植麟看来,“生产力会变成Agent,Agent会产生Token,Token在一定程度上等价于GDP”。站在评价体系的角度,百度创始人李彦宏则提出以“日活智能体数”(DAA)作为AI时代的核心度量衡。他认为,Token不一定代表终局,只代表成本,并不代表收益,衡量的是投入而非产出,DAA则大致对应移动互联网时代通用的度量衡日活用户数(DAU)。

北京商报记者 魏蔚

图片来源:视觉中国

右侧广告

本网站所有内容属北京商报社有限公司,未经许可不得转载。 商报总机:010-64101978 版权合作:010-64101871

商报地址:北京市朝阳区和平里西街21号 邮编:100013 法律顾问:北京市中同律师事务所(010-82011988)

网上有害信息举报  违法和不良信息举报电话:010-84276691 举报邮箱:bjsb@bbtnews.com.cn

ICP备案编号:京ICP备08003726号-1  京公网安备11010502045556号  互联网新闻信息服务许可证11120220001号