NVIDIA 在 IFA 2026 加速本地 AI:PAIR 工具与 RTX Spark 新 PC 亮相
NVIDIA 在 IFA 2026 宣布多项本地 AI 进展:推出免费开源工具 NVIDIA PAIR,可智能调度家庭网络中多台 PC 的推理负载;Hermes Agent、OpenClaw 等应用将简化本地模型配置;llama.cpp 与 vLLM 推理性能最高提升 1.9 倍。同时,联想、宏碁等厂商的 RTX Spark Windows PC 将于十月上市。
核心事实
在 IFA 2026 上,NVIDIA 联合微软及多家合作伙伴,宣布了一系列加速本地 AI 的新工具与硬件。其中,NVIDIA 推出免费开源的 Personal AI Router(PAIR) 软件,可自动发现本地网络中的兼容 PC,并将独立的推理请求路由至有空闲算力的设备,从而让多个 PC 协同处理本地 AI 任务。PAIR 支持 Ollama 与 LM Studio,其测试版适用于 Windows、macOS 与 Linux,兼容 GeForce RTX 20 系列及更新 GPU、RTX PRO 工作站(Turing 架构或更新)、DGX Spark 以及 Apple M4 或更新芯片。
同时,Hermes Agent、OpenClaw 与 Perplexity Portable Computer 等应用将提供更简化的本地模型设置。其中,Hermes Agent 在 Windows 上实现一键式本地模型配置,OpenClaw Windows 应用则简化了在至少 24GB 显存的 RTX GPU 上的模型部署。NVIDIA 还宣布,llama.cpp 在 GeForce RTX 5090 上通过内核优化可实现最高 1.9 倍的吞吐量提升,vLLM 在 RTX PRO 6000 Blackwell 工作站版上提升 1.2 倍,在双 DGX Spark 集群上最高提升 1.4 倍。
背景与影响
这些举措旨在降低本地 AI 代理的使用门槛。此前,用户需要手动选择模型、配置推理服务器并调整量化参数,而新工具与优化将减少此类手动操作。NVIDIA 表示,本地运行 AI 有助于用户将敏感数据保留在设备上,例如 Perplexity Portable Computer 在向云端发送内容前会请求权限。此外,NVIDIA 确认其 RTX Spark Windows PC 将于十月上市,联想发布了 Yoga Pro 9n 与 Yoga 9n 二合一设备,宏碁展示了紧凑型桌面概念机。RTX Spark 搭载 1 Petaflop RTX Blackwell GPU、最高 128GB 统一内存与 20 核 Grace CPU。电子艺界、Embark 与育碧等游戏厂商也宣布将旗下大作带入该平台。
限制与来源
上述性能提升数据(如 1.9 倍、1.2 倍、1.4 倍)均来自 NVIDIA 官方测试,实际表现可能因软硬件环境而异。PAIR 目前为测试版,其功能与兼容性可能随版本更新而变化。RTX Spark 的定价、具体型号与地区可用性尚未完全公布,需以各厂商及 NVIDIA 官网后续信息为准。本文信息基于 NVIDIA 官方博客于 2026 年 9 月 3 日发布的文章《Sparks Fly: NVIDIA Accelerates Local AI at IFA 2026》,更多详情请参阅原文。