全球人工智能芯片领域领军企业英伟达近日宣布,与全球数据中心运营商Equinix及开源模型推理平台Together AI达成战略合作,共同推出面向企业用户的分布式AI推理服务。这项名为"Equinix Inference Exchange"的服务将于2027年第一季度正式投入市场,旨在通过分布式计算架构帮助企业更高效地部署AI应用。
分布式推理技术的核心在于将复杂的AI计算任务拆解为多个子任务,并调度至不同地理位置的服务器集群协同处理。这种架构使AI推理能力能够更贴近企业本地数据源,显著降低数据传输延迟。据技术团队介绍,该方案特别适用于需要实时响应的金融交易、智能制造等场景,以及数据主权要求严格的医疗、政务等领域。
在三方合作架构中,英伟达负责提供底层算力支持与技术标准框架。其推出的企业级参考架构(Enterprise Reference Architectures)整合了计算、网络、存储等硬件资源,通过标准化设计帮助企业规避硬件选型与组网方案的验证成本。该架构特别优化了单位token处理成本,使企业能够以更低预算实现AI规模化应用。
Equinix作为全球最大的互联型数据中心运营商,为项目提供基础设施保障。目前该公司在77个主要城市运营着280余个数据中心,拥有超过230个云接入点,为1.05万家企业提供中立的数据交换平台。其特有的Equinix Fabric互联技术能够无缝连接云服务商、网络运营商和AI企业,形成强大的数字生态网络。数据显示,全球十大AI模型提供商中的八家、前十大AI云服务商中的九家均已将其基础设施部署在Equinix数据中心。
Together AI则负责上层推理平台的运营,其平台支持超过200个开源模型,提供多租户共享与单租户独享两种部署模式。这种设计既满足中小企业低成本试水AI的需求,也能保障大型企业数据隔离的安全要求。平台内置的模型优化工具可自动调整参数配置,帮助企业快速适配不同业务场景。
第三方研究机构麦肯锡的测算数据印证了这一趋势。其报告显示,全球数据中心AI负载将从2025年的44吉瓦增至2030年的155吉瓦,其中推理负载占比将从49.7%提升至60.2%。在基础设施需求方面,推理场景更偏好城域及近城域数据中心,这类站点需要具备低延迟、强网络连接和高效能等特性,而这正是Equinix等互联型运营商的优势领域。
从产业布局看,此次合作标志着AI算力供应模式的重要转变。传统集中式训练中心正在向分布式推理网络演进,这种变化既反映了技术发展的内在规律,也体现了企业对数据安全、处理效率、成本控制等要素的综合考量。随着智能体技术的持续突破,分布式推理架构有望成为下一代AI基础设施的标准配置。










