近日,面壁智能携手OpenBMB开源社区共同宣布,全球首个基于Stencil(模板计算)优化的“自动研究+自动部署”全流程AI系统ForgeStencil正式开源发布。这一创新成果为高性能计算领域带来了新的技术突破,尤其在科学计算与工程仿真场景中展现出显著优势。
根据实测数据,ForgeStencil在单精度(fp32)计算模式下可实现2.35倍的几何平均加速,若采用混合精度模式,性能提升幅度进一步扩大至1.95倍。这一特性使其在处理复杂数值计算任务时,既能保证计算精度,又能显著缩短运算时间。在多个真实应用场景的测试中,该系统均展现出强劲的优化能力:通用CAE求解器hypre的运算效率提升3.86倍,电磁仿真FDTD算法加速2.47倍,而核反应堆中子学计算minisweep的最高加速倍数更达到5.78倍。
Stencil计算作为科学计算的核心范式,广泛应用于流体动力学、电磁场模拟、量子化学等领域。ForgeStencil通过创新性的自动优化框架,将研究阶段的算法探索与部署阶段的性能调优无缝衔接,形成完整的技术闭环。开发者无需手动调整底层代码,即可自动生成针对特定硬件架构的高效实现方案,大幅降低了高性能计算应用的开发门槛。
该系统的开源发布为学术界和产业界提供了重要的技术基础设施。研究人员可基于ForgeStencil快速验证新型算法,企业用户则能通过自动化部署流程提升产品迭代效率。目前,项目团队已公开完整代码库与详细文档,并欢迎全球开发者参与社区共建,共同推动高性能计算技术的演进。











