ITBear旗下自媒体矩阵:

英伟达持续优化Vera CPU调度:新补丁再提性能,系统打磨稳步推进

   时间:2026-09-01 16:02:24 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

英伟达近期在Linux内核优化领域持续发力,针对自研Vera CPU的同步多线程(SMT)调度机制提出创新解决方案。工程师团队通过系统级软件调整,成功将双路系统下的GEMM计算吞吐量提升至10.1 TFLOP/s,较此前基准测试的9.4 TFLOP/s实现7.4%的性能增长。

Vera CPU的Olympus核心采用独特的SMT设计,当核心从双线程模式切换回单线程模式时,需要经历约1万个时钟周期的"资格间隔"才能恢复全速运行。这种延迟机制导致任务在兄弟核间频繁切换时,系统会长期处于性能折损状态。英伟达新提交的调度器补丁通过优化任务分配策略,强制系统优先选择物理核心的PE0作为主执行单元,确保计算任务持续在单一处理单元运行,从根本上避免了性能波动。

技术团队在补丁说明中指出,此次优化建立在前期研究基础之上。今年三月,工程师曾发现Vera Rubin平台在处理CPU密集型任务时存在高达200%的性能损失。通过引入SMT感知的非对称CPU容量调度策略,该问题已得到显著改善。配合八月合并入Linux 7.3内核的NOHZ空闲负载均衡优化,GEMM基准测试吞吐量较初始值6.2 TFLOP/s已提升52%至9.2 TFLOP/s。

这组包含12项代码修改的补丁集已正式提交Linux内核邮件列表审核。优化方案特别针对数据中心场景设计,通过精细化的线程调度管理,在保持SMT技术优势的同时,有效解决了多线程切换带来的性能损耗问题。测试数据显示,在典型HPC负载中,新调度策略可使计算密集型任务的执行效率提升15%-20%。

行业分析师指出,英伟达对系统软件层的深度优化,标志着其自研CPU生态建设进入新阶段。通过持续改进内核调度机制,Vera平台在科学计算、AI训练等关键领域的竞争力得到实质性提升。此次提交的补丁若能通过社区审核,将为Linux生态贡献重要的硬件协同优化方案。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version