动态

DeepSeek v4 Flash用量暴涨6倍后涨价5倍,增长停滞,留下每日10T token的空白机会。

dax
RT @jayair: 好的,让我告诉你DeepSeek v4 Flash发生了什么。

首先背景,它于8月1日发布,两周内,在OpenCode上的每日token处理量从3T增至18T,涨幅6倍,非常惊人。作为参考,这几乎相当于OpenRouter整个日交易量的两倍,也可能占DeepSeek总交易量的30-50%。

这种两周内的暴涨并不正常。原因是该模型异常便宜;比Fable便宜350倍,比5.6 Sol便宜175倍,比Sonnet便宜70倍,比Luna便宜7倍。其次,它相比之前的Flash模型有了明显改进。

我们的用户第一次感受到了“便宜到无需计量”的AI。

然后在8月16日,DeepSeek将价格提高了5倍(高峰时段,非高峰2.5倍)。这完全扼杀了模型的增长。它现在的每日token处理量不足峰值的一半。

显然,人们对这种突然变化感到不满。我们猜测DeepSeek确实无法承受这6倍的荒谬增长。另外,GPU价格上涨也意味着即使他们获得新产能,也无法按原价提供服务。

顺便说一下DeepSeek Flash如此便宜的原因。看起来他们运行了一些自定义基础设施,以更长时间缓存更多token。这很重要,因为我们一直在寻找能够填补DeepSeek Flash留下的近10T日token缺口的供应商。不幸的是,只有少数人能够匹配DeepSeek的原价,而这可能仅仅是因为他们使用了更新的硬件。

这就引出了当前状况。在过去一周里,我们尽可能多地与人沟通,希望以原价托管DeepSeek。问题是,即使有人能做到,他们也很难有足够的容量来处理我们的量。处理我们的吞吐量大约需要1000块B300。

这就是为什么如果你过去几天在Go上使用DeepSeek Flash,体验可能不是最好的。我们不幸地换了好几个供应商。

然而,这每天10T token的缺口,对每个其他模型实验室来说都是一个机会。很明显,市场需要一个至少与DeepSeek Flash一样强大且便宜的模型。

不知何故,这仍然感觉像地板。
动态dax2026-08-21原文

相关内容