ITBear旗下自媒体矩阵:

DeepSeek-V4-Flash正式版来袭,低价高能挑战模型市场新格局

   时间:2026-08-01 03:58:05 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

人工智能领域迎来重要进展,DeepSeek-V4系列模型迎来关键更新。最新推出的DeepSeek-V4-Flash正式版API已开启公测,其专业版DeepSeek-V4-Pro也计划于8月初正式上线。此次迭代距离V4预览版发布已过去三个月,标志着该系列模型进入新的发展阶段。

技术架构方面,Flash正式版延续了混合专家(MoE)架构设计,总参数规模达2840亿,激活参数130亿,支持最长100万token的上下文窗口。该模型在保持与预览版相同架构参数的基础上,通过重新训练优化了性能表现。特别值得关注的是,新版本原生支持OpenAI的Responses API格式,开发者无需修改基础URL即可实现模型切换,同时针对Codex等主流开发工具完成适配优化。

基准测试数据显示,Flash正式版在Agent能力方面实现显著突破。在Terminal Bench 2.1测试中取得82.7分,NL2Repo测试达54.2分,Cybergym测试获得76.7分,其他专项测试如Toolathlon verified(70.3分)、DSBench-FullStack(68.7分)等均展现优异表现。这些成绩较4月发布的Pro预览版有大幅提升,特别是在自动化任务处理和全栈开发能力方面表现突出。

回顾V4系列发展历程,4月24日发布的预览版包含两个版本:Pro版定位高性能旗舰模型,Flash版则通过压缩参数规模实现更低延迟和成本。内部评测显示,Pro预览版在数学、STEM及竞赛级代码任务中已超越多数开源模型,部分指标接近GPT-5.4和Claude Opus 4.6-Max等顶级闭源模型。长上下文处理方面,V4系列在百万token场景下的单token推理计算量较V3.2减少73%,KV缓存占用降低约90%,显著降低资源消耗。

定价策略延续差异化路线,Flash版以显著成本优势吸引开发者:输入命中缓存时每百万tokens仅0.2元,未命中时1元,输出2元;Pro版输入命中缓存1元,未命中12元,输出24元。这种梯度定价既满足不同场景需求,也保持了技术先进性与商业可行性的平衡。

行业动态显示,价格竞争已进入新阶段。OpenAI近期对GPT-5.6 Luna和Terra模型实施最高80%的降价措施,侧面印证国产模型通过技术优化形成的成本优势。当前开发者选型标准正从单纯的价格考量转向综合性能评估,特别是Agent能力的成熟度成为关键指标。DeepSeek此次更新通过提升自动化任务处理能力,证明低成本方案同样可以实现高性能输出,为行业树立新的标杆。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version