英伟达正式以开源测试版形式发布 personal ai router(简称 pair)软件,该工具专为局域网环境设计,用于智能识别并调度本地 ai 计算任务至空闲设备,其角色类似于一位为闲置工位自动分配任务的智能调度员。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

支持即插即用式设备发现与请求分发,Ollama 与 LM Studio 原生受益
PAIR 目前兼容 M4 及更新款 Mac、搭载英伟达 RTX 显卡的 Windows PC,以及 DGX Spark 系统。它为 Ollama、LM Studio 等主流本地 AI 运行平台提供统一接入层,让用户在家庭或办公局域网中,将多个并发 AI 请求动态路由至当前可用的计算节点。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
英伟达将 PAIR 定义为面向局域网的轻量级 AI 请求协调器:它能自动扫描并识别网络中已注册的兼容设备,并依据实时负载状态,将新进请求精准派发至最合适的运行终端。模型推理仍由目标设备上的 Ollama 或 LM Studio 承担,用户无需重复安装、配置或管理各台机器上的 AI 环境。若某设备处于高负载、离线或响应超时状态,PAIR 将自动将其剔除调度队列,并将请求重定向至其他健康节点。例如,在多文档并行审阅场景中,不同子任务可被分发至不同物理设备独立执行。需特别说明的是,PAIR 的核心价值在于提升整体吞吐能力与资源利用率,而非加速单次响应——单个 AI 回复的生成速度不会因接入更多设备而线性提升。
实测数据:5 节点协同使任务耗时从 18 分钟压缩至 8 分 48 秒
据英伟达官方演示,在 Hermes 框架下结合 Ollama 运行 Qwen 3.6 35B A3B 模型,当仅使用一台 RTX Spark 笔记本执行完整任务时,平均耗时为 18 分钟;引入 DGX Spark 与 RTX 5090 构建五节点协作集群后,相同任务的平均完成时间降至 8 分 48 秒。










