来源 | Tech星球

文 | 任雪芸

几个月前,大家还叫DeepSeek创始人梁文锋“梁圣”,后来变成“梁叔”,现在成了“梁子”。称呼一路滑落,撬动最后这一步的,是一张大幅上调的API价目表。

8月17日,DeepSeek V4 Pro与V4 Flash新版定价正式生效,核心规格涨幅远超市场预期:V4 Pro峰时缓存命中单价从每百万Token收费0.003625美元涨至0.044 美元,涨幅达12.14 倍;输出单价从0.87美元上调至3.96美元,涨幅4.55倍;V4 Flash峰时输出单价也从0.28美元涨至 1.32 美元,涨幅4.71倍。

涨价压力正沿着产业链快速向下传导。一名独立开发者向Tech星球透露,其运营的制图Agent平台此前单日Token消耗量在3亿-5亿区间,峰值可达11亿,旧定价体系下月度成本约800元;调价后成本“至少是原来的3倍”。

为了对冲压力,该开发者只能给使用自己平台的终端客户调整计费规则,从按Prompt次数计费,改为按Token消耗折算积分计费,终端售价同步上涨3倍。

落到用户身上是什么概念?之前用户一个月花40美元左右,现在账单一出来轻松突破100美元。而当前用户对她的Agent产品仍以尝鲜心态为主,对百元级月费的接受度极低。

尽管尚未完成流失数据统计,该开发者坦言,客户流失“肯定会发生”。

过去两年,国产大模型一度把Token打到地板价。如今DeepSeek、月之暗面Kimi、智谱 GLM、腾讯云混元等国内主流大模型平台,相继上调API价格。

低价普及时代被画上句号,而对企业、开发者、用户而言,涨价带来的阵痛才刚刚开始蔓延。

4月“承诺”降价,8月却涨价12倍,DeepSeek为何食言?

业内一直有一个共识,DeepSeek影响力很大,但DeepSeek不赚钱。

原因很简单,它的商业模式、没有会员订阅体系,没有增值服务收费,几乎所有收入都来自 API 调用。而在本轮调价之前,DeepSeek的API定价始终贴着国产大模型的价格底线。

一位数据分析师告诉Tech星球,5月时自己给DeepSeek充值了10块钱,1亿Token的总消耗只花了不到16块钱。

更直观的表述是,一亿Token,意味着使用者和AI之间交换了大约几千万字的庞大信息。不考虑反复修改和校正,大约能写出100本长篇小说。

而到了8月调价后,同样是1个亿Token的总消耗,类似的任务状态,该数据分析师表示,高峰期价格“翻了五六倍。”

另一位开发者表示,之前一个月ChatGPT Plus订阅135元,外加DeepSeek50元足够用,“现在一天随随便便DeepSeek就能吃掉十多块。”

涨价之后,DeepSeek与其他国产旗舰模型之间的价差缩小。

以高峰时段缓存未命中场景为例,DeepSeek V4 Pro的输入、输出单价分别为每百万Token 9元、27元人民币;同期智谱GLM-5.2的对应价格约为8元、28元,二者已基本处于同一区间。月之暗面的旗舰模型Kimi K3对应价格则为20 元、100元,仍高出数倍。

但对于熟悉DeepSeek的用户而言,这次涨价出乎意料。

今年4月份时,DeepSeek官方预计,随着今年下半年昇腾950超节点批量上市,V4-Pro模型API调用价格将大幅下调。

但下半年节点已至,开发者等来的不是降价,而是最高超12倍的峰时涨价。

一位行业人士认为,DeepSeek扛不住成本很正常,早期价格足够低是因为大模型应用集中在简单问答上。现在代码生成、智能体、数据分析都属于复杂场景,单次调用所消耗的Tokens不可估量。

更普遍的猜测,指向底层算力供给紧张。

7月的投资者交流会上,梁文锋曾透露,华为目前供给DeepSeek的昇腾950系列芯片产能约1.6万张。另一边,字节跳动、阿里巴巴、腾讯三家巨头已合计采购近45万颗,占华为全年出货计划的六成以上。

无论原因是哪一种,结果已经落地。过去很长一段时间,DeepSeek凭借低价,重新定义了大模型API的价格下限。涨价后横向对比,DeepSeek尚有价格优势。但让开发者们不满的是,涨价后模型得分没有变化,综合成本其实增加得更多。

一个可以观测的窗口是,8月17日DeepSeek涨价后,OpenCode平台上的DeepSeek-V4-Flash调用量较8月16日减少6.17万亿Token,下降59.1%;DeepSeek-V4-Pro调用量减少0.71万亿Token,下降55.7%。

国产大模型,各有各的涨价姿势

在DeepSeek涨价前后,国产大模型们也没有放过这个机会。

创业公司中,月之暗面的Kimi K3,开启最高算力档位时,API输出价格上调至100元/百万Token(词元),比起上一代旗舰模型K2.6的22.4元,涨幅高达3.5倍以上。

智谱AI今年三次上调价格,2月发布GLM-5时上调Coding Plan套餐价格30%起,3月GLM-5-Turbo上线再涨20%,4月GLM-5.1发布后全系API再提价10%,累计涨幅达83%。

大厂阵营的调价路径同样分化。腾讯云的混元2.0模型,输入与输出计费上涨超5倍,最高单项接口涨幅高达463%。

阿里云的Qwen3-Max,商用闭源端价格维持在输入12元/百万Token、输出36元/百万Token区间。不过此前阿里云的Token Plan搞过很激进的优惠:白天1折,夜间0.2折,目前已收紧。

百度的文心一言ERNIE5.1输入8元/百万Token、输出24元/百万Token,企业定制版接近以上价格的2倍,商业化溢价向大客户端转移。

横向对比全球市场,国内外大模型的价格梯队呈现出清晰的分层差。

顶级模型区间仍存在量级差距:海外第一梯队Anthropic Claude Fable 5、OpenAI GPT-5.6 Sol 的定价,依旧是国产旗舰的数倍至十倍。

但中端主力区间价格正在快速靠拢:xAI Grok 4.6的价格开始与阿里通义Qwen 3.8 Max、DeepSeek V4 Pro处于相近量级,国内外模型在主流场景的成本差距持续收窄。

至于轻量模型,价格则开始接轨。OpenAI GPT-5.6 Luna 短上下文档(输入 1.36 元、输出 8.15 元),价格甚至略低于DeepSeek V4 Flash高峰价,双方在平价赛道的定价已基本接轨。

(数据来源网络,千问办公制图)

就在一两年前,国内大模型行业还深陷价格战泥潭,各家厂商为抢占市场份额,将API价格压至地板价,但这种低价本质是短期补贴换规模,算力成本属于不可回避的刚性支出。

从 “价格屠夫”DeepSeek带头涨价开始,国产大模型的低价竞争阶段正式宣告终结。全行业正集体从“烧钱换规模”转向成本回收与商业化盈利,竞争逻辑也从单纯的比价,转向“能力、性价比” 的综合较量。

长期来看,顶级能力模型的国内外价差仍将存在,但中端主力模型的定价会持续靠拢。国内厂商的竞争重心,终将从比便宜变成比能力。

只是当价格逐步与国际接轨,新的考验才刚刚浮出水面。

低价红利退潮,开发者如何应对?

DeepSeek涨价落地后,“寻找替代方案”是开发者圈的普遍反应,但不同体量的用户走出了不同的应对路径。

受冲击最直接的,是长期依赖第三方低价套餐的高强度开发者。

过去,大量重度用户并不直接按官网API价付费,而是通过OpenCode等第三方编程套餐获取远低于官方的调用额度,这曾是代码生成、高频推理等大算力场景的核心省钱渠道。

随着DeepSeek调价,主流第三方渠道已同步传导成本压力,这条低价路线快速收窄。

比如,OpenCode已调整其Go套餐的使用上限。OpenCode公布的额度对比显示,DeepSeek V4 Flash的限额由此前每5小时约63300次降至3800次,降幅约94%;V4 Pro则由3450次降至1050次。

其他渠道中阿里云、腾讯云跟涨,华为云和火山引擎也宣布了调整时间。

一位原本从OpenCode订阅的用户向Tech星球表示,正在寻找更便宜的第三方平台,“不过目前还没找到。”

对背负客户成本压力的B端开发者而言,换模型是最直接的止损方式。

前述运营制图Agent平台的独立开发者坦言,模型成本直接决定自身的终端定价与客户留存,她已开始调研替代选型,“可能会换成GPT”,通过切换底层模型来平抑成本。

而对于自用为主的个人开发者,更普遍的选择是 “降档+错峰”的折中方案。

上述个人开发者选择保留DeepSeek,但只在低峰谷价时段调用,且优先使用价格更低的V4 Flash,放弃成本更高的V4 Pro,通过调整自己的使用习惯消化涨价幅度。

此外,还有一条更隐蔽的应对路径:提高缓存命中率。

上述数据分析师称,在连续对话和长文本场景下,缓存命中率是一个非常重要的指标。“如果命中率足够高,单价上涨也不意味着总账单更贵。“尽可能把提示词做好,再去平衡成本。”

放到更大的企业级市场看,账面价值的差距还会被商务折扣进一步抹平。有云厂商销售透露,国产旗舰模型中,智谱、Kimi等品牌的合作可拿到5折甚至更低的折扣。

这也让涨价后的DeepSeek V4 Pro陷入了微妙的处境:性能不及海外顶级模型,向下价格优势又被竞品折扣大幅稀释。

告别了价格碾压的舒适区,DeepSeek与国产大模型们,都将迎来真正的实力比拼。