ITBear旗下自媒体矩阵:

DeepSeek Harness内测将启?V4正式版或携三大升级及峰谷定价同步登场

   时间:2026-07-30 05:15:37 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

近日,一则关于DeepSeek Harness工具即将开启内测的消息在AI社区引发热议。一张疑似内部测试招募通知的截图显示,该工具计划于本周晚些时候启动内测,首批用户将从特定群组中筛选,入选者需提交个人信息并签署保密协议,否则将面临取消资格及影响后续合作机会的处罚。尽管截图真实性尚未得到官方确认,但结合DeepSeek此前发布的V4正式版延期公告,以及项目负责人崔添翼曾透露Harness将与V4同步推出的信息,这一传闻的可信度显著提升。

作为DeepSeek近期重点推进的项目,Harness的研发过程始终保持高度保密。目前公开的信息主要围绕两方面展开:一是项目负责人崔添翼的量化交易背景,二是DeepSeek发布的招聘职位描述。崔添翼在量化领域深耕九年,其主导的交易系统以毫秒级响应、异常自动恢复和全流程日志追溯为核心特性。这些经验或被直接应用于Harness的设计中——例如要求AI推理-执行-反馈循环必须极致高效,避免冗余操作;系统需具备容错能力,在工具调用失败时自动切换备用方案;同时通过完整的操作日志实现任务回溯,定位模型决策错误的具体环节。

招聘职位的描述进一步揭示了Harness的技术架构。其中提到的KV Cache优化和长上下文管理技术,表明该工具将动态调整计算资源分配:简单任务使用短上下文降低成本,复杂任务则启用百万token级长上下文。向量存储方案和会话持久化功能意味着Harness具备长期记忆能力,可跨对话保留用户编码习惯、项目架构等个性化信息。工具调用方面,系统支持链式编排、错误回退和动态注册新工具,甚至允许Agent自动发现并使用新功能。多Agent协作架构则通过主从分工模式提升效率——主Agent负责任务拆解与结果聚合,子Agent在独立上下文中执行具体操作,单个模块故障不影响整体流程。

Harness的推出与DeepSeek V4正式版的发布密切相关。原定于7月中旬上线的V4正式版至今未现身,仅在7月24日完成API接口更名,将旧版deepseek-chat和deepseek-reasoner替换为deepseek-v4-flash和deepseek-v4-pro。据参与灰度测试的用户透露,正式版在核心推理能力、响应速度和Agent执行效率上有显著提升,整体表现接近Opus 4.8水平,编码能力与GPT-5.6 Sol相当,且任务迭代轮次更少。但这些说法尚未得到官方证实,当前预览版仍存在编程任务依赖外部资源、复杂场景需手动强化推理强度等问题,多模态能力也亟待完善。

定价策略成为另一争议焦点。V4正式版将引入峰谷定价机制,高峰时段(北京时间9:00-12:00及14:00-18:00)API价格翻倍。例如V4 Pro缓存未命中输入的平时价为3元/百万token,高峰时段涨至6元;输出价格则从6元升至12元。这种差异化定价虽为用户提供了算力调度选择,但也意味着办公时段运行相同任务的成本将大幅增加。此前DeepSeek曾多次调整定价模式,从2025年2月的夜间折扣到9月取消优惠并上调输出价格,此次变动再次引发对成本控制的讨论。

第三方测试数据显示,不同Harness工具在完成相同任务时的资源消耗差异显著。以DeepSeek V4 Flash为例,Claude Code平均需要70次工具调用,而OpenCode仅需22次;弱Harness(如Pi)失败的任务,在强Harness中可能成功执行。这表明Harness的设计水平直接影响模型性能与使用成本。如何在保证系统鲁棒性的同时优化资源利用率,将成为DeepSeek需要解决的关键问题。不过从过往表现看,该团队在成本控制方面向来具有优势,此次Harness的最终实现效果仍值得期待。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version