资讯🔥7.0

NVIDIA Releases Personal AI Router (PAIR): An Open Source Virtual Inference Router that Distributes Local AI Requests Across RTX, DGX Spark, and Mac Nodes

marktechpost.com·2026/9/5 03:52:23🔗 原文

📋总体概括

NVIDIA开源发布个人AI路由器PAIR,作为虚拟推理路由器,把家庭网络内已有机器上的本地AI请求分发到RTX、DGX Spark和Mac节点。PAIR代理现有Ollama和LM Studio端点,代理框架无需改动,其调度器按节点就绪状态、引擎状态、模型是否精确存在、任务负载和GPU利用率筛选节点。官方五子代理演示中,单台RTX Spark笔记本平均耗时18分钟,三设备集群缩短至8分48秒,但NVIDIA标注其为非官方演示而非基准测试。PAIR也存在局限:单一调度策略,且不感知显存容量与模型预热状态。

关键信息

  • NVIDIA开源PAIR,可在家庭网络内把本地AI请求分发至RTX、DGX Spark和Mac等异构节点
  • PAIR代理现有Ollama与LM Studio端点,代理框架无需任何改动即可接入
  • 调度器按就绪状态、引擎状态、精确模型存在性、任务负载和GPU利用率五项条件筛选节点
  • 五子代理演示:单台RTX Spark笔记本平均18分钟,三设备集群8分48秒,NVIDIA强调非基准测试
  • 局限包括调度策略单一、不感知VRAM容量与模型预热状态

🔥犀利点评

PAIR本质是给消费级异构算力做负载均衡的胶水层,聪明在不动应用层——代理Ollama/LM Studio端点,迁移成本为零。但18分钟对8分48秒这种50%加速,官方自己都不好意思叫基准,说明收益高度依赖任务切分粒度。真正硬伤是不感知VRAM和模型预热:本地推理最贵的恰恰是把大模型搬进显存的那几十秒,调度器看不见这一点,实际体验可能远不如演示流畅。方向对,成熟度还在demo阶段。

本文由本站自动聚合,以下为原始来源:前往 marktechpost.com 阅读全文