在科技界围绕人工智能模型“开源”与“闭源”的激烈讨论中,芯片行业巨头英伟达正以实际行动展现其对开源生态的支持。据内部人士透露,该公司正在秘密研发新一代人工智能模型系列Nemotron 4,目标直指全球顶尖开源模型的性能标杆。
这款尚未正式发布的新模型引发了行业高度关注。知情人士称,Nemotron 4系列中参数规模最大的版本预计将突破万亿级别,其研发团队由数百名工程师组成,目前正处于最终训练阶段。尽管具体发布时间尚未确定,但有消息称最快可能在今年第四季度面世。
开源模型近期成为行业焦点,多重因素推动其热度持续攀升。随着全球范围内AI监管法规的密集出台,以及中国研发的低成本模型在性能上逐步逼近美国头部企业的领先系统,开源方案正获得越来越多开发者的青睐。近期频发的自主AI智能体安全事件,更暴露出闭源模型在网络安全领域的潜在风险,进一步加剧了市场对开源技术的需求。
在推进Nemotron 4研发的同时,英伟达本周二同步推出了两款重要产品。新发布的Nemotron 3.5 Lightning专为代码审查、安全监控等企业级应用优化,通过知识蒸馏技术将大型模型的能力压缩到更小的参数规模中。企业生成式AI软件副总裁Kari Briski解释称,这种设计既保证了专业任务的执行质量,又显著降低了计算资源消耗。
另一款开源工具NeMo Switchyard则展现了英伟达在模型路由领域的创新。这个智能调度系统能够根据任务特性自动匹配最合适的AI模型,在响应速度、处理精度和运营成本之间实现动态平衡。Briski强调,该技术可帮助企业将常规任务分流至小型模型,避免过度依赖高成本的大型系统。
企业数据安全与知识产权保护成为开源模型推广的关键考量。Briski指出,许多专业领域公司担忧将核心数据交给第三方AI服务商可能引发竞争风险。开源方案的优势在于允许企业基于自有数据对模型进行微调,既满足定制化需求,又能确保数据主权。这种模式在网络安全、材料科学等敏感行业尤其具有吸引力。
英伟达自身也是开源战略的受益者。Briski透露,Switchyard的研发初衷正是为了优化公司内部的AI资源分配,在控制Token消耗的同时保护技术专利。她表示:"当模型处理量达到亿级规模时,成本优化就成为关乎竞争力的核心问题。"
行业动态显示,开源领域的竞争正在加剧。就在英伟达新品发布前夕,meta推出了可在消费级设备上运行的Muse Glimmer模型,其轻量化设计直接挑战了传统大型模型的部署门槛。这场开源与闭源的技术路线之争,或将重塑未来AI产业的发展格局。











