NVIDIA 在柏林舉行的 IFA 發表多項新消息,包括下月上市的 RTX Spark 系統,以及協助部署地端 AI 的模型與軟體更新。其中,受關注的 NVIDIA PAIR(Personal AI Router),能將區域網路內多台電腦的運算資源整合起來,並自動分配 AI 推論工作。
NVIDIA 開源免費軟體 PAIR,串起家庭與中小企業閒置電腦跑地端 AI
NVIDIA PAIR 會將網路上的 RTX、DGX 和 Mac 系統整合成個人 AI 推論叢集,並自動把 AI 推論請求分配到可用的地端運算資源。在家中執行 AI 工作流程,資料全程留在自己的網路內。這個軟體是專為私有的地端 AI 推論打造,讓使用者可以處理提示詞、檔案與 AI 代理的上下文資訊,不必將這些資料傳送到雲端。
過往,將 AI 模型和工作集中在同一台電腦上未必是理想做法,因為不同用途和軟體都得共用記憶體、儲存空間、網路及運算資源。《Forbes》指出,這正是 NVIDIA PAIR 可以發揮作用的地方。許多家庭和中小型企業都擁有多台電腦,而這些設備大多時間處於閒置狀態。NVIDIA PAIR 是免費的開源軟體,可以利用這些閒置設備的運算資源來執行地端 AI。
《Forbes》提及,如今大多數代理式 AI 工作流程都會把任務拆分成許多不同工作,同時處理其中多個部分。但如果所有任務都要搶用同一顆 GPU 的運算資源,效能就可能忽快忽慢,甚至大幅下降。在區域網路中的多台電腦安裝並設定 NVIDIA PAIR 後,軟體會自動找出相容的運算設備,再根據各系統當下的可用資源,將 AI 推論工作分配到最合適的電腦上。
NVIDIA PAIR 整合多台電腦運算能力,能自動分配任務?
NVIDIA PAIR 支援 Ollama 與 LM Studio,當網路中的電腦或裝置加入或離開時,也能自動調整。當使用者要求地端 AI 代理執行多項任務時,PAIR 會把工作分配給網路上可用的電腦,而不是全部交給主機處理,避免所有任務擠在同一顆 GPU 上。
換句話說,NVIDIA PAIR 能把多台電腦的運算能力整合起來,讓地端 AI 代理可以同時處理更多任務。使用者也可以把 AI 工作交給其他電腦執行,讓主要電腦繼續處理其他事情。
《Forbes》專欄作家 Marco Chiappetta 認為,未來許多 AI 推論工作都可能採用這種模式。家庭和小型企業往往擁有不少閒置的運算設備,從桌上型電腦、筆記型電腦,到寬頻路由器和智慧裝置都有。與其把資料送到雲端、再支付雲端 AI 服務的費用,不如直接利用這些地端設備的運算能力。
目前 NVIDIA PAIR 已推出 Beta 版本,支援 Windows、macOS 和 Linux,並提供圖形介面與終端機介面。硬體方面,目前支援 NVIDIA GeForce RTX 20 系列及更新型號、採用 Turing 架構及更新架構的 RTX Pro 工作站 GPU、DGX Spark,以及 Apple M4 或更新版本的晶片。NVIDIA 尚未公布其他硬體平台的支援計畫,但未來不排除擴大支援範圍。



