DeepSeek砍价75%说永久,我看到了三个更深的信号
DeepSeek砍价75%说"永久",我看到了三个更深的信号
降价75%,还说是永久的
5月22号晚上,DeepSeek发了个公告,我看完直接愣了一下。
不是小打小闹的打折,是永久降价75%。原来2.5折的促销价,到期后不再恢复,直接变成正式价。
也就是说,如果你之前觉得"6月就要涨价了赶紧用"——不用急了,这个价格,永远就这样了。
这不是什么限时优惠,这是重新定价。
先看数字,感受一下力度
V4 Pro 新价:输入每百万tokens 3元,输出6元。缓存命中更是只要0.025元。
原价是多少?输入12元,输出24元。直接砍掉四分之三。
V4 Flash更便宜:输入1元,输出2元。
你可能觉得"3块钱6块钱也不便宜啊"——那我给你个参照:同级别的Claude Opus,输出每百万tokens大概150元。DeepSeek是它的二十五分之一。
不是便宜一点,是便宜了一个数量级。
为什么降?我翻了三个原因
官方公告没解释原因,只说了"降价"两个字。但我把最近的新闻串起来看,觉得答案其实挺明显的。
第一个原因:架构效率真的提上去了。
V4 Pro用的是Engram架构,1.6T总参数49B激活的MoE模型。相比V3.2,同等任务只需要27%的token消耗,KV cache只有原来的10%。翻译成人话就是:同样跑一次,V4 Pro花的算力不到V3的三分之一。成本降了,价格自然能降。
第二个原因:昇腾950进来了。
这是最近圈内讨论最多的事。有消息说,DeepSeek V4已经在华为昇腾950的A3集群上跑通了。8K输入延迟约20ms,Decode约4700 TPS——这个数据不比英伟达差。
为什么重要?因为算力不再只靠英伟达了。多了一个供应商,议价权就上来了,成本空间就出来了。
第三个原因:生态打法。
DeepSeek拿了700亿融资,国家大基金领投。它不缺钱,缺的是用户量和生态黏性。API价格降到这个程度,所有中小开发者、创业公司都会涌过来。这不是在做生意,是在圈地。
并发限制也调了,这是另一只靴子
降价的同时,DeepSeek还调了并发限制。V4 Flash并发500,V4 Pro并发2500。
超过就429。
看着像"降价又限流,等于没降"?不是。
官方说得很直白:之前有人用API反代,大量白嫖算力,影响正常用户。限制并发主要是打这帮人的。
对正常开发者来说,V4 Pro 2500的并发,够用了。真正被卡的是那种开反代站薅羊毛的。
这件事的深层含义,比降价本身更大
我琢磨了一下,觉得这件事背后有三层信号,值得每个人想想。
第一层:大模型API的定价体系,正在崩塌。
以前的定价逻辑是:模型多大→训练多贵→API就定多贵。但现在,架构优化+国产算力+规模效应,把成本结构彻底打穿了。V4 Pro的性能不输GPT-5,价格却只有人家几十分之一。这意味着"按参数量定价"的时代快结束了,未来是"按实际成本+微利"来定。
第二层:算力去英伟达化,正在从PPT变成现实。
昇腾950跑通V4 Pro,CANN生态从"概念验证"到"Triton原生兼容"——这些变化意味着,国产AI算力不再是"能用但慢",而是"能用而且够快"。当你的推理不再100%依赖英伟达GPU,你的成本就有巨大的下降空间。
第三层:对普通人来说,AI应用要爆发了。
API价格降到这个水平,意味着开发一个AI应用的后端成本几乎可以忽略不计。以前做一个AI客服、AI写作助手、AI编程工具,每个月API费动辄几千几万。现在?可能几百块就搞定了。
我判断,接下来半年到一年,会有一波AI应用创业潮。不是因为技术突破,而是因为成本终于降到了普通人玩得起的程度。
说个我自己的判断
我觉得DeepSeek这一步,不是在跟OpenAI打价格战。
它在做一件更根本的事:重新定义AI的计价单位。
以前我们说"1个token多少钱",以后可能说的是"1个Agent运行1小时多少钱",甚至"1个AI应用服务1个用户1个月多少钱"。
当推理成本无限趋近于零,商业模式就不可能还是"卖token"。谁先想清楚新的计价方式,谁就是下一轮的赢家。
DeepSeek用75%的降幅告诉你:我准备好了,你们呢?
更多推荐




所有评论(0)