华为近日在ChinaXiv平台发布预印本论文,详细阐述了其自主研发的τ(韬)缩放定律及其在芯片设计中的创新应用。这项突破性技术通过重构芯片内部信号传输路径,成功解决了3D堆叠架构长期面临的散热难题,为摩尔定律失效后的半导体发展开辟了新路径。
传统芯片性能提升主要依赖晶体管尺寸微缩,但受限于EUV光刻技术瓶颈,华为转而聚焦信号传输延迟优化。其提出的τ缩放定律通过逻辑折叠技术,将原本平铺的电路层进行垂直堆叠,利用微米级互连桥接替代传统水平走线。这种设计使麒麟2026芯片的晶体管密度达到2.38亿/平方毫米,较前代提升55%,相当于传统工艺三年累积的进步幅度。
实测数据显示,在相同性能条件下,麒麟2026的NPU功耗较前代下降66%,GPU功耗降低58%,CPU大核功耗减少41%。这种反直觉的能效提升源于信号传输路径的革命性改变——芯片70%以上的能耗消耗在数据搬运环节,而逻辑折叠使互连长度缩短90%,直接削减了互连电容产生的动态功耗。配合工作电压的同步降低,形成功耗下降的复合效应。
技术团队特别指出,不同功能模块的收益存在显著差异。AI计算核心NPU在保持29TOPS算力时,通过降低63%的工作频率和35%的电压,实现功率密度暴跌73%。而DSP模块虽总功耗下降25%,但单位面积功率密度因面积缩减40%出现短期上升,该问题已在下一代麒麟2027中得到优化解决。
针对CPU大核的串行计算特性,华为采用渐进式改进策略。麒麟2026已实现3.1GHz主频,未来计划通过键合工艺升级和堆叠层数增加,在3-5年内将频率推升至5GHz以上。这种分阶段优化策略,避免了因强行折叠导致的验证风险。
该架构的创新不仅体现在能效提升,更构建了动态工作模式。在涡轮增压模式下,麒麟2026的NPU算力可飙升至70TOPS,GPU帧率提升42%,满足高性能场景需求。系统可根据任务类型在省电模式与性能模式间智能切换,这种灵活性源于芯片内部高温/低温模块的交错布局设计。
热管理方案突破了传统堆叠思维,通过选择性折叠和热感知布局,将发热模块分散至不同物理层,配合横向导热通道设计,使晶体管结温始终处于安全范围。这种设计哲学与软件工程中的阿姆达尔定律形成呼应,通过任务分发机制减少大核负载,充分发挥并行计算单元的能效优势。
论文强调,τ缩放定律的本质是时间维度优化而非单纯追求低功耗。折叠架构既支持低温运行模式,也可通过提升频率获取性能增益。每代芯片通过时间裕量的转化,在功耗或性能维度持续迭代,形成螺旋式上升的技术演进路径。









