商业洞见

DeepSeek 登顶调用量第一,AI 价格战把谁逼到了墙角

8 月 3 日,DeepSeek-V4-Flash 以 7.22 万亿 Token 周调用量登顶 OpenRouter 全球榜首。同一天,OpenAI 的 GPT-5.6 Luna 刚降价 80% 应对。中国模型连续十四周调用量超美国,但“便宜”不等于“能赚钱”——算法能力的较量已经过去,场景闭环才是新的赛点。

6 分钟阅读2 次阅读更新于
DeepSeek 登顶调用量第一,AI 价格战把谁逼到了墙角

事件概述

8 月 3 日,海外开发者平台 OpenCode 公布了一组数字:DeepSeek-V4-Flash 单日处理 Token 量达到 8 万亿,其中约 3 万亿来自开发者付费调用。同一天,全球最大 AI 模型 API 聚合平台 OpenRouter 的周报也显示,在 7 月 27 日至 8 月 2 日这一周,DeepSeek-V4-Flash 以 7.22 万亿 Token 的周调用量登顶全球榜首。

这是中国 AI 大模型连续第十四周在调用量上超过美国。OpenRouter 榜单前五名全是国产模型:DeepSeek-V4-Flash、小米 MiMo-V2.5、腾讯 Hy3、DeepSeek-V4-Pro、智谱 GLM-5.2。据腾讯新闻报道,OpenRouter 汇聚了超过 400 款模型,月活约 800 万注册用户。

价格同样刺眼。DeepSeek-V4-Flash 正式版 API 于 7 月 31 日上线,定价为输入每百万 Token 0.14 美元、输出 0.28 美元;缓存命中场景下,输入低至 0.02 元人民币。新浪财经援引 AI 评测机构 Artificial Analysis 的数据称,完成同一套标准化基准测试,DeepSeek V4 Flash 平均费用约 0.03 美元,而 Anthropic Claude Fable 5 要 3.15 美元,OpenAI GPT-5.6 Sol 要 1.86 美元。

对手的回应来得很快。7 月 30 日,OpenAI 宣布 GPT-5.6 Luna 降价 80%,输入从每百万 Token 1 美元降到 0.2 美元,输出从 6 美元降到 1.2 美元。Terra 同步降价 20%。这个时间点,就在 DeepSeek V4 Flash 正式版上线前一天。

商业拆解

主流叙事把这解读成“中国模型碾压美国”,但调用量榜首和价格战本质上是两回事。调用量高,说明开发者愿意试;价格战,说明厂商被迫降。DeepSeek 真正做到的,是把“性价比”从营销话术变成了可量化的成本结构。

它的手段并不神秘。MoE 架构,2840 亿总参数,每次推理只激活 130 亿参数。用更少的活跃算力,换来了接近旗舰模型的表现。新浪财经报道,V4 Flash 在 Artificial Analysis 的 Intelligence Index 智能指数中获得 50 分,与 Google Gemini 3.6 Flash 相当。性能差距没有价格差距那么夸张。

这套逻辑的冲击对象,首先是闭源模型的定价权。过去两年,OpenAI、Anthropic、谷歌用性能榜单定义了“好模型该卖多少钱”。DeepSeek 用 130 亿激活参数证明,前沿智能不一定非要用最顶配的价格来买。海外开发者社区已经出现迁移潮,多名 AI 初创公司创始人在 X 平台表示,团队全线迁移到 DeepSeek 后,月度推理成本下降了 60% 到 85%。

但调用量高不等于商业模式稳。据科创板日报援引业内人士分析,AI 编程每一次 API 调用都有真实的 GPU 推理成本,边际成本无法像移动互联网软件那样趋近于零。摩根士丹利的一份报告被新浪财经引用,指出在特定假设下,GPT-5.6 Luna 降价后需要 107% 的利用率才能覆盖成本。这说明价格战不是无成本补贴,而是真实盈利能力承压。

角度深挖

一个被忽略的角度是:模型能力逼近白菜价,卖模型的人未必最赚钱,把模型嵌进业务闭环的人可能赚得更多。

OpenCode 单日 8 万亿 Token 里,有 5 万亿是免费试用。这个数字说明两件事:尝鲜用户极多,付费转化还在早期。DeepSeek 把门槛砍到地板价,抢到了开发者注意力。但注意力不等于利润,尤其开源模型还允许本地部署和商业修改,API 收入本身会被稀释。

科创板日报援引国投证券科技行业首席分析师马良的观点,认为当前价格战更像一种“市场出清”机制,淘汰成本结构不够优化、差异化不清晰的玩家。光大证券首席资产配置研究员王开则判断,降价有真实的技术降本支撑,AI 编程正从尝鲜工具转变为普惠生产力基础设施。

这两句话合起来看,价格战其实是 AI 应用层分层的前奏。基础模型拼成本、高端模型拼能力上限,中间地带最容易被挤掉。对品牌和创业者来说,“调用哪个模型”已经没那么关键了,重点变成“模型接进哪个场景”。

举个直接的例子。一个做客服智能体的公司,如果核心竞争力只是“接入了 GPT-4”,那现在很危险,因为换接 DeepSeek 可能便宜几十倍。但如果核心竞争力是“懂某个垂直行业的对话流程、有私有数据沉淀、能持续优化回复策略”,那模型降价反而利好——成本下来了,毛利空间就出来了。

启示判断

截至发稿时,OpenAI Luna 降价后的市场表现还在发酵,Anthropic 也将 Fable 5 免费体验变成长期权益。价格战不会停,但终点不会是“谁最便宜谁赢”。

最后活下来的大概两类公司:一类是像 DeepSeek 这样能把成本压到极致、用开源扩大生态影响力的基础模型厂商;另一类是扎根具体场景、把模型当成基础设施来用的应用层公司。中间那层“包装一个 API 接口就收费”的工具,会越来越难做。

对普通企业用户和品牌方来说,现在是一个窗口期。AI 调用成本断崖式下降,但“买了更便宜的 API”的人不一定拿到红利,能把 API 接进真实业务流程的人才算占到便宜。模型已经白菜价了,后面要比的是业务理解、数据沉淀和闭环能力。

常见问题

分享文章

严震楠

严震楠

AI商业架构专家

品牌GEO优化研究者 · HaiAwake思维流提出者 · 十年商业策划经验

了解更多 →

留言讨论

0/1000

加载中…

需要专业的商业策划?

无论是商业策划、品牌升级,还是AI架构部署,我们都能为您提供专业的解决方案。