8月4日上午,海外开源AI Coding Agent平台Open Code发文称,DeepSeek V4 Flash因“前所未有的访问量”出现容量不足问题。用户调用API时频繁遭遇报错,官方随即启动紧急修复。
多名开发者同步反馈,DeepSeek V4 Flash官方API上午“几乎不可用”。有网友将这一情况与月之暗面Kimi K3刚发布时的算力挤兑相类比:“国产模型能力赶上来了,但可用性与容量仍有改善空间”。
截至当日下午,DeepSeek官方已确认API性能下降问题已解决,服务全面恢复。
这并非国产大模型首次因需求“过载”而出现服务波动。7月19日,Kimi K3上线仅48小时,用户请求量便大幅超出预估并逼近集群承载极限,月之暗面被迫暂停C端新用户订阅,将有限算力优先保障已付费用户。彼时Kimi方面表示已在全速推进算力扩容。
DeepSeek V4 Flash于7月31日正式开启API公测,定位为轻量版模型,主打高性价比。其定价为每百万输入Token0.14美元、输出Token0.28美元,每项智能指数任务平均测试成本仅3美分,不到Anthropic旗舰模型Claude Fable5的百分之一。这一极致性价比在开发者群体中迅速引爆需求,直接触发了此次容量挤兑。