商业洞见

价格战的发起者先涨价了,DeepSeek在算什么账

8月6日,DeepSeek发布涨价公告:"预计涨幅较大"。这个把大模型API价格压到地板的公司,第一个举起了涨价牌。背后是Agent时代Token消耗百倍增长、算力成本持续走高、行业集体回归理性定价的三重压力。价格战的发起者先涨价了。

9 分钟阅读0 次阅读更新于
价格战的发起者先涨价了,DeepSeek在算什么账

8月6日的公告

8月6日上午,DeepSeek在开发者后台贴了一条公告。全文不到50个字:计划近期整体上调API服务定价,预计涨幅较大。

开发者社区的反应挺热闹。AI博主"数字生命卡兹克"在社交平台写:"理智告诉我,训练贵,推理也贵,涨价完全合理。但是感情告诉我,你小子浓眉大眼的,怎么也叛变了。"这条帖子几小时涌进几百条评论,讨论涨价的边界在哪里、有没有替代品。还有人给梁文锋起了外号,把"梁圣"降级成"牢梁"。

DeepSeek是这一轮大模型价格战的发起者。2024年4月,它把API价格压到输入1元/百万Token、输出2元,行业叫它"地板价"。其他厂商要么跟降,要么解释为什么不跟。两年后,这个发起者第一个举起了涨价牌。

这不是一条普通的调价通知。价格战的急先锋宣布不打了,而且要加价。两个月前我们还在分析这场价格战谁在流血,现在流血的人开始止血了。

从地板价到涨价的曲线

把DeepSeek的定价轨迹画出来,是一条先下后上的U型线。

  • 2024年4月:输入1元/百万Token、输出2元。行业地板价。
  • 2025年2月:优惠期结束,价格微调,仍在低位。
  • 2025年9月:再降50%以上。
  • 2026年5月:V4-Pro的2.5折限时优惠转永久价,输入3元、输出6元。
  • 2026年6月底:预告V4正式版引入峰谷定价。工作日高峰时段(9:00-12:00、14:00-18:00)价格翻倍。当时市场还把这个解读为"精细化调度",不算涨价。
  • 2026年8月6日:捅破了。不是时段调节,是整体定价中枢上移。

目前V4-Flash平峰输出价2元/百万Token,V4-Pro为6元。高峰翻倍后分别是4元和12元。"涨幅较大"具体多大,正式方案还没出。但官方建议开发者"合理安排使用",话说到这个份上,意思不用猜了。

从一路下探到掉头向上,转折点在6月的峰谷定价。当时给市场的印象是"调节"而非"涨价"。八周后的全面涨价公告说明,峰谷定价只是试探,真正的定价重置在后头。

Agent吃掉了Token

涨价最直接的推力是需求。

8月3日,开源AI Agent工具OpenCode披露了一组数据:8月1日单日,DeepSeek V4 Flash在其平台处理了8万亿Token。其中5万亿来自免费额度,3万亿来自付费。

8万亿Token是什么概念?2024年初,国内日均Token调用量大约1400亿。到2026年,这个数字变成了140万亿,增长了1000倍。OpenCode单日8万亿,相当于2024年全行业将近6天的量。

问题出在Agent。

传统对话AI,用户问一句模型答一句,消耗几千到几万Token。Agent不一样。一个Agent任务可能持续数小时,中间调几十次工具,每次工具调用的输入输出都算Token。OpenCode的数据显示,Agent单任务的Token消耗是传统对话的百倍以上。

DeepSeek因为便宜,成了开发者跑Agent的首选。美国研究机构Artificial Analysis的测评显示,DeepSeek-V4-Flash跑完一次基准测试的成本是0.03美元。作为对比,Kimi K3是0.86美元,GPT-5.6 Sol是1.86美元,Claude Fable 5是3.15美元。差了近百倍。

用量上去了,服务顶不住。8月4日,DeepSeek V4 Flash API因"前所未有的访问量"出现容量不足,开发者集中吐槽响应超时。官方说问题已解决,但体验受损是事实。低价把开发者吸引过来,Agent把Token消耗放大百倍,容量不够用了。

算力账单

需求端在膨胀,供给端在缩。

高端AI芯片产能受限,供应紧张。这不是DeepSeek一家的问题。腾讯云在2026年不到一个月内连续两次涨价,原因也是算力成本。芯片采购贵了,数据中心运营贵了,每一层都在往上加价。

DeepSeek的处境比大厂更直接。它没有腾讯、阿里那样的大规模自建数据中心,算力依赖外部采购。芯片涨、云服务涨,成本压力传导更快。

算一笔粗账。V4-Flash平峰输出价2元/百万Token。一个Agent任务消耗100万Token(这在Agent场景里算少的),开发者付2块钱。这2块钱要覆盖推理算力、带宽、运维。如果算力成本在涨,API价格不变,每处理一个Token都在亏。

之前的循环是:低价换规模,规模换效率,效率降成本。算力便宜的时候这个循环转得动。算力变贵了,循环断了。低价引来的海量调用不再是优势,变成了负担。用的人越多,亏得越多。

不止DeepSeek在涨

DeepSeek不是第一个涨的。

智谱AI年内三次上调API价格。月之暗面Kimi K3输入价格涨超3倍、输出涨近4倍。腾讯云连续两次涨价。MiniMax、百度智能云也有调整。

但DeepSeek涨价的市场反应最大。因为它是"价格屠夫"。它定义了这一轮价格战的地板,现在地板要抬了。

工业和信息化部信息通信经济专家委员会委员盘和林接受《金融时报》采访时说:"DeepSeek之前的价格一直在行业中低位,其涨价有标志性意义。"

标志性意义在于:它说明"亏本赚吆喝"的阶段翻篇了。行业从拼低价抢用户转向成本可承受前提下的商业化。

全球也在调。OpenAI把入门模型Luna降价80%、中端模型Terra降价20%,但高端模型维持高溢价。低端走量清场、中端守盘盈利、高端溢价锁客,这是OpenAI的组合拳。区别在于,OpenAI有资本支撑这套打法。国内模型公司大多还在亏损,算力又贵,走不了太久。关于这点,我们在企业AI落地服务中接触过不少客户,算力预算是绕不过去的坎。

开发者怎么办

对开发者来说,"随便跑"的奢侈没有了。

过去两年,DeepSeek的低价让很多人敢把Agent真正跑起来。不用算Token成本,不用担心账单。涨价之后,需要重新评估Token消耗,优化调用逻辑,甚至做多模型路由。简单任务用便宜模型,复杂任务才用贵的。

有些团队已经在调整。一种做法是把更多简单请求分流到免费模型,只把复杂问题留给付费模型。另一种是压缩每个请求的上下文长度,减少不必要的Token消耗。还有一种更直接:重新评估哪些Agent任务真的需要跑,哪些可以降频或关掉。

这些调整会变成常态。Token经济学从"怎么用得爽"变成"怎么用得省"。

涨价后DeepSeek还能不能保住OpenRouter调用量第一的位置?7.22万亿Token的周调用量,第二名望尘莫及。但调用量第一不等于利润第一。涨价是把双刃剑,涨太少覆盖不了算力账,涨太多开发者跑了。具体涨幅还没出,先看看正式方案再说。

分享文章

严震楠

严震楠

AI商业架构专家

品牌GEO优化研究者 · HaiAwake思维流提出者 · 十年商业策划经验

了解更多 →

留言讨论

0/1000

加载中…

需要专业的商业策划?

无论是商业策划、品牌升级,还是AI架构部署,我们都能为您提供专业的解决方案。