ITBear旗下自媒体矩阵:

中国开放权重模型崛起:海外AI研发新引擎,技术输出引领全球新趋势

   时间:2026-08-28 03:07:58 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

近年来,中国开放权重模型在全球人工智能产业链中的参与度显著提升,Kimi、DeepSeek等模型的能力不断增强,正成为海外企业开发新模型和产品的重要技术支撑。从直接作为基础模型接受训练,到提供合成数据、模型架构参考,中国模型的技术输出形式日益丰富,国际影响力持续扩大。

美国法律AI公司哈维近期发布的Tenet模型,便是这一趋势的典型案例。该模型以中国月之暗面公司开发的Kimi K3为基础,通过约1750个专业化法律工作智能体环境进行迭代优化,历时两个月完成训练。测试数据显示,专项训练后的Tenet在综合法律实务任务中的完成量接近原始Kimi K3的两倍,合同起草、审查等专项任务的完成量也提升约20%,同时保留了原模型的通用法律知识能力。相比之下,市场上多数通用模型在专业场景中的任务完成率不足10%,凸显了中国模型在垂直领域的技术优势。

在编程领域,中国模型同样表现活跃。美国AI编程平台“光标”代码编辑器所属公司今年3月发布的技术报告显示,其开发的Composer 2模型以Kimi K2.5为基础,通过代码数据预训练和强化学习优化,实现了从通用模型向专项智能模型的转型。5月推出的Composer 2.5进一步扩大训练规模,性能持续提升。美国“认知”公司和英国Cosine公司也基于Kimi模型,通过强化学习提升软件工程能力,推出了各自的AI软件工程产品。

中国模型的影响力还延伸至训练数据和架构设计。开放人工智能研究中心前首席技术官米拉·穆拉蒂创办的思维机器实验室,在研发首款开放权重模型Inkling时,虽未直接采用中国模型作为基础,但其混合专家架构主要参考了DeepSeek V3的技术路线。在后训练阶段,该实验室还使用Kimi K2.5等模型生成合成数据,用于首轮监督微调,体现了中国模型在技术生态中的渗透力。

过去,AI企业普遍依赖闭源模型追求前沿技术,但随着中国开放权重模型能力的提升,这一局面正在改变。部分中国模型已跻身全球前沿行列,为海外企业提供了闭源模型之外的替代方案。尤其是在人工智能向智能体演进的背景下,模型能力评估标准从知识回答转向复杂任务执行,垂直领域的后训练更注重任务执行能力。Cursor、哈维等公司通过在接近真实业务的环境中开展强化学习,使模型掌握信息搜索、工具调用等技能,进一步凸显了中国模型在任务适配性上的优势。

开放权重模型的另一大优势在于成本和控制。企业可自主部署、优化和训练这些模型,在大规模调用场景下降低单位推理成本,提高部署灵活性,减少对外部API的依赖。这种特性使其在需要高频调用的业务中更具竞争力。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version