在近期举办的国际消费电子展会上,英伟达宣布对本地人工智能应用进行全面升级,推出多项突破性技术以降低AI部署门槛并提升运行效率。三款主流智能体应用Hermes Agent、OpenClaw和Perplexity Portable Computer将支持Windows系统的一键本地部署功能,用户无需手动下载模型或调整参数,系统可自动检测GPU型号并完成配置优化。
性能优化方面,大语言模型推理框架llama.cpp在GeForce RTX 5090显卡上实现1.9倍推理吞吐提升,Qwen3.6-27B模型 token处理效率提高50%,35B版本更达到90%的加速效果。针对专业级应用,vLLM框架在RTX PRO 6000 Blackwell显卡上实现20%速度提升,双DGX Spark集群的推理性能则提升至1.4倍。这些技术突破使得本地AI运行效率显著接近云端水平。
Perplexity Portable Computer作为重点升级应用,将于9月同步登陆Windows和Linux平台。该应用要求用户配备24GB以上显存的英伟达显卡,部署后可实现完整工作流本地化运行,既避免积分消耗,又确保数据隐私——仅在用户明确授权后才会将部分任务上传至云端处理。这种混合运行模式既保证了性能,又兼顾了安全性。
另外两款支持一键部署的应用各具特色:由Nous Research开发的Hermes Agent作为通用型智能体,具备跨任务上下文保持、跨会话记忆积累等能力,可随使用时间增长自动优化技能库;OpenClaw则凭借超过38万GitHub星标成为最大开源AI项目,其模块化设计支持高度定制化开发。
为进一步释放家庭算力潜力,英伟达同步推出NVIDIA PAIR工具测试版。该工具可自动扫描局域网内所有兼容设备,将独立推理请求智能分配至空闲GPU,实现多机协同计算。目前支持Windows、macOS和Linux三大操作系统,兼容RTX 20系列及更新显卡,普通用户无需专业设备即可组建家庭AI计算集群。









