ITBear旗下自媒体矩阵:

英伟达发力开源AI模型:Nemotron 3.5 Lightning登场,万亿参数4代蓄势待发

   时间:2026-08-12 04:06:00 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

英伟达近期在开源人工智能模型领域动作频频,不仅推出了Nemotron 3.5 Lightning模型,还同步开源了智能路由工具NeMo Switchyard,同时加速研发下一代Nemotron 4系列,展现出其在AI模型层的战略野心。

Nemotron 3.5 Lightning是英伟达最新扩充的开源模型,被定位为针对长时间运行AI智能体工作负载效率最优的解决方案。这款拥有300亿参数的混合专家模型,专为开发者构建高效AI智能体应用设计。与传统聊天机器人不同,AI智能体需要处理多步骤推理、调用工具并完成复杂任务,因此模型运行效率、推理成本及模型间调度能力成为关键。英伟达通过Nemotron 3.5 Lightning切入这一快速增长领域,同时推出开源库NeMo Switchyard,为企业提供智能模型路由功能。该工具可根据任务需求自动匹配最合适的AI模型,无需修改现有应用程序,支持PC、工作站、数据中心和云端等多计算环境部署。

在Nemotron 3.5 Lightning之外,英伟达正在推进规模更大的Nemotron 4系列开发。据知情人士透露,该系列最大模型的参数规模预计至少达1万亿,是今年6月推出的Nemotron 3 Ultra的两倍。英伟达希望Nemotron 4在性能上跻身全球顶尖开源AI模型行列,为此已就预训练数据和模型架构作出部分决策,但最终训练尚未启动,整个过程可能耗时数月。有员工预计该模型最快今年秋季完成,也有人认为发布时间可能推迟。

英伟达的模型战略并非孤立行动。今年3月,公司成立Nemotron Coalition,联合全球多家领先AI实验室开发开源前沿模型。该联盟打造的首个模型将成为Nemotron 4系列的基础。英伟达生成式AI副总裁Kari Briski表示,公司投资开源模型是为了让企业和国家都能获取前沿技术,增强安全性、加速创新,并提供跨技术世代的基础。这一战略标志着英伟达从单纯的GPU供应商向AI生态建设者转型。

然而,Nemotron战略也让英伟达陷入微妙竞争局面。一方面,公司与部分投资的开源AI初创企业形成潜在竞争;另一方面,在模型层面与OpenAI、Anthropic等重要GPU客户产生业务重叠。例如,OpenAI是英伟达AI芯片的重要需求方,而英伟达也向其投资了300亿美元。尽管Nemotron 4旗舰模型预计仍不及OpenAI和Anthropic的最先进闭源模型,但开源方案因其成本更低、控制力更强,正被越来越多企业视为部分工作负载的替代方案。英伟达无需Nemotron直接击败闭源模型,只要推动开源普及和AI部署,就能对其GPU业务形成正向反馈。

尽管投入增加,Nemotron的实际性能与全球最先进模型仍有差距。英伟达目前最大的模型Nemotron 3 Ultra在美国开源模型中排名第二,落后于Thinking Machines的Inkling,但在全球范围内甚至未进入前40名。这使Nemotron 4成为检验英伟达模型战略的关键产品。若下一代模型能显著缩小与全球领先开源模型的差距,英伟达将不仅拥有GPU、网络、服务器系统和AI软件平台,还将掌握开源模型这一关键环节,形成更完整的AI技术栈。从商业角度看,英伟达推动Nemotron的最终目标仍是扩大GPU需求:开源AI越普及,企业部署场景越丰富,全球对AI计算资源的需求就越可能增长。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version