EPISODE · Aug 21, 2026 · 2 MIN
DeepSeek v4 Flash 調價五倍後日用量跌至高峰一半以下,暴露低價模型供應瓶頸
from EasyVibeCoding Podcast · host Jay
DeepSeek v4 Flash 調價五倍後日用量跌至高峰一半以下,暴露低價模型供應瓶頸。 使用量暴增 Jay 指出,DeepSeek v4 Flash 的 18T token 日用量接近讓 OpenRouter 的每日總量翻倍,也可能占 DeepSeek 全部用量的 30% 至 50%。他認為,兩週內出現這種規模的跳升並不正常,主因有兩點: 價格極低,比 Fable 便宜 350 倍、比 5.6 Sol 便宜 175 倍、比 Sonnet 便宜 70 倍、比 Luna 便宜 7 倍。 相較前一代 Flash model,能力有明顯改善,讓使用者第一次感受到「便宜到不必計量」的 AI。 調價造成反效果 DeepSeek 在 8 月 16 日將尖峰時段價格調升為五倍,離峰時段調升為兩點五倍;結果模型成長幾乎完全停滯,日用量降至高峰的一半以下。Jay 猜測,DeepSeek 可能確實無法承受原本六倍的流量躍升;此外,GPU 價格上漲也意味著即使取得新容量,仍難以維持原先價格。 低價來源與供應瓶頸 Jay 推測,DeepSeek Flash 使用了客製化基礎架構,能快取更多 token 並維持更長時間。OpenCode 因此持續尋找供應商填補每日近 10T token 的缺口,但能匹配原始價格的業者只有少數,而且多半可能依賴較新的硬體。要支撐目前吞吐量,估計需要約 1,000 張 B300;即使供應商有能力以原價提供服務,也很難準備足夠容量。這也是近幾天 Go 上的 DeepSeek Flash 使用體驗不穩定、服務不斷更換供應商的原因。 市場機會 這個每日 10T token 的缺口,對其他 model lab 是明確機會:市場顯然需要一個能力至少相當、價格同樣低廉的模型;在 Jay 看來,DeepSeek Flash 的原始價格甚至可能只是市場可接受的底線。原文:https://easyvibecoding.app/curated/3073-deepseek-v4-flash-daily-usage-surges-sixfold
Embed this episode
Ready to play
DeepSeek v4 Flash 調價五倍後日用量跌至高峰一半以下,暴露低價模型供應瓶頸
No transcript for this episode yet
Similar Episodes
No similar episodes found.
Similar Podcasts
No similar podcasts found.