Nvidia PAIR 让你的闲置 Mac 和 PC 为 AI 智能体工作
英伟达推出开源软件路由器 PAIR,可利用家中闲置的 Mac 和 PC 运行本地 AI 模型,加速智能体工作流;它兼容 Ollama/LM Studio,支持英伟达 GPU 与 M4 芯片 Mac,现已开放测试。
英伟达长期以来一直押注开放模型和本地 AI,其收购 Hugging Face 的动作会进一步加速这一方向。在产品层面,英伟达也在努力让更多潜在用户在自己设备上运行 AI 模型。周四,英伟达发布了 Nvidia Personal AI Router(PAIR)——一个面向家庭网络的开源软件路由器,可以用家中闲置的 Mac 和 PC 按需运行小型模型,并借助子智能体加速智能体工作流。
PAIR 的主要目标是加速 NemoClaw、OpenClaw 或 Hermes 这类智能体,让它们能够并行使用更多子智能体。工作方式是由主智能体把任务拆给多个子智能体,而这些子智能体的模型请求可以运行在闲置的电脑上。
英伟达称 PAIR 为“虚拟推理路由器”,并明确强调这不是新的推理引擎。它会利用某台机器上已经安装好的 Ollama 或 LM Studio 来运行模型。PAIR 安装在每一台电脑上后,可以通过 mDNS 发现本地网络中的不同系统,并检查它们是否有能力处理请求。
需要说明的是,PAIR 不会把单个推理请求拆分到多个机器上。英伟达强调,它不合并 GPU,也不把显存池化成单个加速器,更不能把一个推理请求分散到多台机器执行。
英伟达解释说:“智能体可以通过它熟悉的本地界面发送请求。PAIR 通过其代理接收请求,识别引擎和模型要求,并选择一个符合条件的节点。该节点从头到尾执行请求,再通过 PAIR 把响应返回。对智能体来说,它始终看到的是一条连接,而 PAIR 在背后负责调度。”
PAIR 支持 Windows、macOS 和 Linux 以及兼容 GPU。具体而言,最低要求是 Nvidia GeForce RTX 20 系列或更新的显卡,或配备 M4 或更新芯片的 Mac,或 Nvidia DGX Spark。值得注意的是,尽管 Mac 不使用 Nvidia GPU,英伟达仍然支持了 Mac。今年晚些时候 RTX Spark PC 和笔记本上市后,也会得到支持。
每台机器可以放不同模型,但 PAIR 只会把请求路由到已启用所需引擎且具备所请求模型的节点。如果多台机器装了同一个模型,路由器就能更灵活地分发并发请求。
PAIR 会持续关注哪些电脑处于可用状态。一旦用户回到某台电脑办公或玩游戏并重新占用 GPU,该机器上的本地推理引擎就会停止。在英伟达的示例中,用两台配备 RTX 5090 显卡和 32GB 显存的高端 PC(目前价格约为 5000 美元,尽管初始官方建议零售价是 2000 美元)运行 Qwen3.6 35B A3B 模型,五个子智能体的速度提升了约 1.6 倍。
当然,家里很少人会有好几张 RTX 5090,甚至还有几台 DGX Spark。所以真实场景中,比如一台 Mac Studio、几台 Mac mini 加一台游戏 PC 的效果还有待观察,但即便如此也应该能加速本地智能体工作流。
Nvidia PAIR 目前以测试版形式提供。开始使用只需将它安装到每一台希望加入网络的机器上,让它发现并配对系统,并确保这些机器安装了 Ollama 或 LM Studio 且已下载所需模型。PAIR 也能帮助安装 Ollama 或 LM Studio,并在配对的电脑上发起模型下载。