DeepSeek砍价75%说"永久",我看到了三个更深的信号

降价75%,还说是永久的

5月22号晚上,DeepSeek发了个公告,我看完直接愣了一下。

不是小打小闹的打折,是永久降价75%。原来2.5折的促销价,到期后不再恢复,直接变成正式价。

也就是说,如果你之前觉得"6月就要涨价了赶紧用"——不用急了,这个价格,永远就这样了。

这不是什么限时优惠,这是重新定价。

先看数字,感受一下力度

V4 Pro 新价:输入每百万tokens 3元,输出6元。缓存命中更是只要0.025元。

原价是多少?输入12元,输出24元。直接砍掉四分之三。

V4 Flash更便宜:输入1元,输出2元。

你可能觉得"3块钱6块钱也不便宜啊"——那我给你个参照:同级别的Claude Opus,输出每百万tokens大概150元。DeepSeek是它的二十五分之一

不是便宜一点,是便宜了一个数量级。

为什么降?我翻了三个原因

官方公告没解释原因,只说了"降价"两个字。但我把最近的新闻串起来看,觉得答案其实挺明显的。

第一个原因:架构效率真的提上去了。

V4 Pro用的是Engram架构,1.6T总参数49B激活的MoE模型。相比V3.2,同等任务只需要27%的token消耗,KV cache只有原来的10%。翻译成人话就是:同样跑一次,V4 Pro花的算力不到V3的三分之一。成本降了,价格自然能降。

第二个原因:昇腾950进来了。

这是最近圈内讨论最多的事。有消息说,DeepSeek V4已经在华为昇腾950的A3集群上跑通了。8K输入延迟约20ms,Decode约4700 TPS——这个数据不比英伟达差。

为什么重要?因为算力不再只靠英伟达了。多了一个供应商,议价权就上来了,成本空间就出来了。

第三个原因:生态打法。

DeepSeek拿了700亿融资,国家大基金领投。它不缺钱,缺的是用户量和生态黏性。API价格降到这个程度,所有中小开发者、创业公司都会涌过来。这不是在做生意,是在圈地。

并发限制也调了,这是另一只靴子

降价的同时,DeepSeek还调了并发限制。V4 Flash并发500,V4 Pro并发2500。

超过就429。

看着像"降价又限流,等于没降"?不是。

官方说得很直白:之前有人用API反代,大量白嫖算力,影响正常用户。限制并发主要是打这帮人的。

对正常开发者来说,V4 Pro 2500的并发,够用了。真正被卡的是那种开反代站薅羊毛的。

这件事的深层含义,比降价本身更大

我琢磨了一下,觉得这件事背后有三层信号,值得每个人想想。

第一层:大模型API的定价体系,正在崩塌。

以前的定价逻辑是:模型多大→训练多贵→API就定多贵。但现在,架构优化+国产算力+规模效应,把成本结构彻底打穿了。V4 Pro的性能不输GPT-5,价格却只有人家几十分之一。这意味着"按参数量定价"的时代快结束了,未来是"按实际成本+微利"来定。

第二层:算力去英伟达化,正在从PPT变成现实。

昇腾950跑通V4 Pro,CANN生态从"概念验证"到"Triton原生兼容"——这些变化意味着,国产AI算力不再是"能用但慢",而是"能用而且够快"。当你的推理不再100%依赖英伟达GPU,你的成本就有巨大的下降空间。

第三层:对普通人来说,AI应用要爆发了。

API价格降到这个水平,意味着开发一个AI应用的后端成本几乎可以忽略不计。以前做一个AI客服、AI写作助手、AI编程工具,每个月API费动辄几千几万。现在?可能几百块就搞定了。

我判断,接下来半年到一年,会有一波AI应用创业潮。不是因为技术突破,而是因为成本终于降到了普通人玩得起的程度

说个我自己的判断

我觉得DeepSeek这一步,不是在跟OpenAI打价格战。

它在做一件更根本的事:重新定义AI的计价单位

以前我们说"1个token多少钱",以后可能说的是"1个Agent运行1小时多少钱",甚至"1个AI应用服务1个用户1个月多少钱"。

当推理成本无限趋近于零,商业模式就不可能还是"卖token"。谁先想清楚新的计价方式,谁就是下一轮的赢家。

DeepSeek用75%的降幅告诉你:我准备好了,你们呢?

Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐