ITBear旗下自媒体矩阵:

DeepSeek V4.1 Flash登陆国家超算互联网 成本降低性能超越旗舰模型

   时间:2026-09-11 03:17:48 来源:天脉网编辑:快讯 IP:北京 发表评论无障碍通道
 

国家超算互联网中心今日迎来新成员——DeepSeek V4.1 Flash模型正式上线。用户只需登录官网并进入模型服务页面,即可轻松访问该模型的API调用界面,开启高效智能应用新体验。

作为一款552B参数的MoE架构模型,DeepSeek V4.1 Flash采用创新的Causal-Encoder-Decoder结构设计,实现了输入输出激活参数的差异化配置。其输入激活参数仅8B,输出激活参数16B,在保持模型性能的同时,将运行成本压缩至同类规模产品的显著水平以下。通过引入新型预训练机制与大规模强化学习后训练技术,该模型在多项基准测试中表现优异,甚至超越了DeepSeek V4 Pro等旗舰级产品。

在硬件资源优化方面,新模型展现出突破性进展。通过深度压缩KV Cache缓存结构,其对高带宽内存(HBM)的需求较前代降低75%,固态硬盘(SSD)存储需求减少87.5%。这种优化在智能体(Agent)应用场景中效果尤为显著——缓存命中成本的大幅下降,直接降低了复杂任务处理的总体开支,为大规模商业化部署铺平了道路。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version