近期,大模型领域一款名为DeepSeek V4 Flash的产品引发广泛关注。尽管它并非当前性能最强的大模型,却在国内外市场掀起热潮,尤其在0731正式版升级后,性能大幅提升,用户量呈爆发式增长,甚至导致官方服务器出现服务掉线的情况。
OpenCode平台公布的数据显示,DeepSeek V4 Flash的用量惊人。仅在8月1日,该模型的用量就达到8万亿Token,而自4月预览版发布以来,它一直是OpenCode平台上用量较大的主力模型之一。从6月10日至8月4日,其在OpenCode上的总用量高达90万亿Token。
如此庞大的用量,成本却低得令人咋舌。DeepSeek V4 Flash在OpenCode上的使用成本仅为92万美元,平均每1亿Token的综合成本仅1.02美元。这一价格优势,使其在市场上极具竞争力。
在API收费方面,DeepSeek V4 Flash与其他大模型形成鲜明对比。OpenAI及Anthropic的收费标准是DeepSeek V4 Flash的几十倍,而像Fable 5这类级别的大模型,费用更是高达其100倍以上。若OpenCode上的用户选择使用这两家的大模型进行开发,成本上涨30 - 50倍是常见现象。
随着用户量的急剧增加,DeepSeek V4 Flash的服务器压力剧增。近日,不少网友发现使用该模型时出现503报错,提示服务器过于繁忙。面对这一情况,DeepSeek官方也无可奈何,甚至建议用户暂时使用其他大模型服务商的产品。
然而,用户似乎并不愿意轻易切换。其他大模型不仅价格昂贵,而且在性能上能超越DeepSeek V4 Flash 0731正式版的寥寥无几。即便其他服务商部署了DeepSeek V4 Flash 0731正式版,API收费也无法做到像DeepSeek这般低廉。国内其他几家大模型平台的缓存命中费用是官方定价的10倍,而DeepSeek V4 Flash的缓存命中率极高,经常超过90%,这意味着用户若更换平台,使用成本将大幅增加。
此前,梁文锋在投资会议演讲中提到,团队在C端并未投入过多精力进行获客或刻意维护,但用户却表现出极高的认可度和留存率,可谓“赶都赶不走”。如今看来,DeepSeek在成本控制方面的技术优势,或许是吸引用户并保持高留存率的关键因素,其他企业难以轻易复制这一优势。











