DeepSeek想赚钱,最大的对手却是自己
文|蓝字计划,作者|Hayward
DeepSeek史上最声势浩大的一次全面涨价,只持续了23天。
8月17日,DeepSeek正式调整V4系列的API价格。无论是主打性价比的Flash,还是能力更强的Pro,输入和输出价格都明显上涨。有的媒体甚至在精打细算之下,算出了高达1100% 的涨幅。

当时不少人都觉得,那个靠低价震惊世界的DeepSeek,终于也准备认真赚钱了。
结果新价格还没满月,DeepSeek又突然宣布降价。价格松动的,是负责走量、主打性价比的Flash模型。
从9月10日12点开始,Flash系列的缓存命中输入最高降价60%,缓存未命中输入降价约33%,输出价格也有所下调。

不过,更有意思的是,DeepSeek V4 Flash的这次降价,降了又没有完全降。在一些关键的指标上,几乎没变。
再加上就在9月9日宣布降价的当天下午,DeepSeek又爆出一个新的大瓜。
据路透社报道,DeepSeek已经聘请中信证券筹备科创板IPO,计划今年启动上市程序。不过,具体上市时间、募资规模和目标估值,目前都还没有确定。

这次降价,恐怕没有“最高降价60%”看起来那么简单。
DeepSeek,到底降了多少
或许在一切开始之前,我们还是先得看看DeepSeek这次降了多少。
今年4月,V4 Flash刚刚发布时,DeepSeek采用全天统一价。每百万Token的缓存命中输入0.02元,缓存未命中输入1元,输出2元。
所谓缓存命中,就是模型发现同一段内容以前处理过,可以直接拿来用的数据,一般都是收费最便宜的;
而缓存未命中代表模型第一次处理这些内容,所有计算都得重头开始;输出就更直观了,就是AI最终生成的文字、代码和答案,也就是AI最终返回给我们的结果。
而到了8月17日,DeepSeek宣布给整个V4系列更新价格,分为峰价和谷价。
工作日上午9点到12点、下午2点到6点属于高峰,其他时间按照则按谷价收费。
调整之后,Flash在空闲时段的缓存命中输入涨到0.05元,缓存未命中输入涨到1.5元,输出涨到4.5元。高峰时段的价格还要再翻一倍。
也就是说,工作日下午调用Flash,每百万Token的输出价格从2元直接涨到了9元。
顺带一提,上面提到的媒体算出的1100%涨幅,出现在V4 Pro身上。它的缓存命中输入,从此前每百万Token 0.025元的长期优惠价,涨到了高峰时段的0.3元,整整变成原来的12倍。
而这次DeepSeek的价格调整,只出现在Flash模型上。

最显眼的是“最高降价60%”,指的是空闲时段的缓存命中输入,从0.05元降回0.02元,和今年4月V4 Flash刚发布时完全一样。
缓存未命中输入也从1.5元降到1元,同样回到了4月的价格。
但是,在这次降价中没有跟上脚步的,是输出价格。
Flash在空闲时段的输出价格从4.5元降到4元,降幅只有约11%。和4月最初的2元相比,现在依然贵了一倍。
到了高峰时段,缓存命中输入、缓存未命中输入和输出分别是0.04元、2元和8元。相比4月的统一价格,两项输入还是贵了一倍,输出更是原来的4倍。
至于一个月前也跟着一起涨价的V4 Pro,这次价格完全没动。
所以,DeepSeek这次主要收回了Flash的输入涨幅,输出价格只是象征性地往下降了一点。
虽说输出Token不一定是一次调用中账单里的大头,但因为价格往往是最贵的,所以也是用户最烧钱的部分。
如果按照现在降价后的价格来算,它的单价已经是普通输入的4倍、缓存输入的200倍了。
由此可见,虽然是降价了,但是按照DeepSeek的这个降价规划,它依然认为V4 Flash应该卖得比以前更贵。
既然始终认为V4 Flash应该更值钱,那为什么DeepSeek还是得降价呢?
V4 Flash “卖爆了”,但还得降价
DeepSeek没有公开这次降价的具体原因,我们也看不到它自家API的调用账本。
不过,从其他平台公开的调用数据里,还是能找到一些蛛丝马迹。
全球最大的AI模型调用平台之一OpenRouter,每天都会公布不同模型处理的Token数量。用户可以在这个平台充值,再通过同一个接口调用DeepSeek、GPT、Claude等不同模型。
截至9月8日,V4 Flash 0731过去30天一共处理了约50.7万亿Token,位列OpenRouter所有模型第一。最近一周,它又处理了约12.4万亿Token,排名第三。

如果把DeepSeek旗下的不同模型加在一起,它们占据了OpenRouter最近一周约23.8%的文本请求,甚至压过了OpenAI和Google。
所以,V4 Flash显然不缺人用。
但当我们点开V4 Flash在OpenRouter上的页面,事情就开始变得有意思了。
提供这款模型的供应商,足足有28家。DeepSeek官方只是其中之一。
因为V4 Flash开放了模型权重,任何有服务器和技术能力的公司,都可以把它部署到自己的机器上,再把API卖给开发者。
卖的都是V4 Flash,价格却可以差上不少。
在OpenRouter目前列出的供应商中,OpenInference每百万Token的输入价格为0.05美元,输出价格为0.16美元。DeepSeek官方在高峰时段的价格,则分别为0.44美元和1.32美元。就算按照空闲时段减半计算,也要0.22美元和0.66美元。

便宜的供应商可能会在速度、模型精度和稳定性上有所区别。但对一部分只想降低成本的开发者来说,价格差得够多,就值得换过去试试。
更重要的是,他们根本不需要放弃DeepSeek。
代码不用大改,任务也不用重新适配。很多时候只需要换一个API地址,背后运行的依然是V4 Flash,钱却交给了另一家公司。
当然在这里得叠个甲,这组数据绝对不意味了DeepSeek是因为第三方平台的竞争才选择降价,一切还是得以官方口径为准。
但这组数据还是有价值的。它至少说明了现在V4 Flash面对的来自自己“分身”的竞争非常激烈。
这也是开源模型必须面对的“宿命”。毕竟其他闭源模型涨价以后,用户要么咬牙付钱,要不就用其他的。但DeepSeek涨价以后,用户还能继续使用DeepSeek,甚至不需要给DeepSeek交钱。
偏偏就在降价前一天,DeepSeek又开放了V4.1 Flash中间版本的测试。
按照DeepSeek的说法,新版本采用了新的模型架构,能力更强、速度更快,运行成本也更低;甚至因为能力已经全面超过了V4 Pro,他们还打算在模型正式上线之后,在V4.1 Pro上线之前,把所有V4 Pro的模型请求接到V4.1 Flash上。

这么强的能力,本来应该成为DeepSeek守住涨价的底气。可V4.1 Flash刚刚进入测试,DeepSeek先做的却是把Flash系列的价格降下来。
答案可能就在DeepSeek最成功的地方。
它实在太便宜了。
成也性价比,败也性价比
便宜,一直是DeepSeek最锋利的武器。
当其他大模型还在按美元计算成本时,DeepSeek直接把API价格以人民币算,并打到了地板上。久而久之,大家也形成了一个根深蒂固的印象。
DeepSeek就应该便宜。
这种印象有多难改变?商业史上已经上演过很多次。
2002年,大众推出旗舰轿车辉腾。为了把它送进豪华车市场,大众投入超过10亿欧元研发,产品直接瞄准奔驰S级和宝马7系,售价也一度达到7.6万欧元。

可它从未完成每年销售2万辆的目标。直到2013年,大众只生产了5812辆辉腾。
毕竟同样的价格摆在面前,大家肯定想买奔驰、宝马和奥迪,很难说服自己花豪华车的钱,买一辆挂着大众车标的汽车。
DeepSeek现在碰到的,也是类似的问题。
V4 Flash当然很便宜,问题在于,外面还有一大群比DeepSeek官方更便宜的“DeepSeek”。大家用着同一套模型权重,得到的答案也差不多,官方接口想要涨价,开发者们不可能乖乖买你的账。
而且,之前最让人担心的情况还是出现了。
8月全面涨价的时候,V4 Flash依然是原来的V4 Flash。用户付出了更高的价格,却没有同时拿到一个能力更强的新模型。
这对一直以性能、性价比为标签的DeepSeek来说,确实是大忌。要不然梁文锋的“滑动变祖器“,也不会”长时间停在“牢梁“这边了。
甚至这次价格调整,也显示了DeepSeek目前最难受的地方。输出价格舍不得全部降回去,说明它依然想提高收入;输入价格又率先大幅回落,说明它也不能完全放弃自己最重要的性价比优势。
一边要赚钱,一边还要守住“便宜”的招牌。众所周知,“既要又要”一直都是最难受的。
当然,或许也只是DeepSeek同样落入到了每个商业公司都需要审视的困难罢了:想让用户接受涨价,至少得让他们看到,自己多花的钱究竟换来了什么。
DeepSeek的定价想走向高端,最大的对手可能不只是GPT和Claude,还有那个曾经惊艳全世界的自己。
加载中,请稍侯......