DeepSeek开放平台近日宣布,将对旗下Flash系列模型的调用价格进行下调,调整将于北京时间9月10日中午12时正式生效。此次降价涉及缓存命中、缓存未命中及输出三个维度,最高降幅分别达到60%、33.33%和11.11%,旨在进一步降低用户使用成本,提升模型应用普及度。
根据调整方案,空闲时段输入缓存命中价格将从每百万Token 0.05元降至0.02元,未命中缓存的输入价格由1.5元调整为1元,输出价格则从4.5元降至4元。高峰时段价格维持空闲时段两倍的规则,但具体数值同步下调:输入缓存命中价格由0.1元降至0.04元,未命中缓存的输入价格由3元降至2元,输出价格由9元降至8元。此次调整覆盖所有使用场景,用户无需额外申请即可享受新价格。
此次价格调整适用于DeepSeek Flash系列全部两款模型,包括支持多模态输入的deepseek-v4-flash-vision-exp和专注于文本处理的deepseek-v4-flash。两款模型在功能定位上存在差异,但均采用统一的价格调整标准,确保不同需求用户均能受益。平台方表示,此次降价是持续优化服务成本结构的结果,未来将继续通过技术迭代降低模型运行成本。
价格调整后,DeepSeek Flash系列在同类产品中的竞争力显著提升。以输入缓存命中场景为例,调整后的空闲时段价格较市场同类产品低约40%,高峰时段价格优势也达到20%以上。输出价格方面,尽管降幅相对较小,但仍保持行业中等偏下水平。此次降价或引发AI模型调用市场的连锁反应,推动行业整体服务价格进一步下探。











