英偉達以開源測試版狀態推出 Personal AI Router(PAIR)軟件,用於在局域網內爲本地 AI 請求選擇可用計算機,相當於把任務分派給空閒工位的調度員。

image.png

自動發現設備並分派請求,Ollama 與 LM Studio 直接受益

在兼容設備上,PAIR 可以在 M4 及更高版本的 Mac、英偉達 RTX PC 和 DGX Spark 上運行,爲 Ollama、LM Studio 等本地 AI 工具提供統一的請求入口。用戶可在家庭或辦公局域網內,把多個獨立的 AI 請求調度至空閒設備處理。

英偉達將 PAIR 定位爲局域網內的本地 AI 請求調度軟件,它能自動發現已加入的電腦,並將每項請求分配給可用設備。模型仍由目標設備上的 Ollama 或 LM Studio 運行,因此用戶不必爲每款 AI 應用分別配置每一臺機器。當某臺設備繁忙或不可用時,PAIR 會把新請求轉向其他已配對設備。比如 AI 智能體同時審閱多份文檔時,可將彼此獨立的任務分別交給不同計算機處理。英偉達強調,這一機制面向併發負載分擔,並不意味着單個 AI 回覆會因爲接入更多電腦而自動變快。

實測:任務拆分後從 18 分鐘縮短到 8 分 48 秒

英偉達演示顯示,在 Hermes 中使用 Ollama 與 Qwen 3.6 35B A3B 模型,將任務拆分給 5 個 AI 子智能體後,RTX Spark 筆記本單機平均完成時間爲 18 分鐘;加入 DGX Spark 和 RTX 5090 後,平均時間縮短至 8 分 48 秒。