地端AI系統,實現AI Agent智慧模型路由
MSI 微星科技今日宣布,其 XpertStation WS300 與 EdgeXpert 平台現已支援 NVIDIA Nemotron 3.5 Lightning —專為Agentic AI打造的輕量化開源模型,以及 NeMo Switchyard —開源模型路由函式庫。
Switchyard 透過系統化模型調度,將每個工作流程步驟導向最適合的模型,例如將複雜推理交由前沿規模模型處理,並將大量、專門化任務交由 Nemotron 3.5 Lightning 等輕量模型處理,藉此提升準確度、降低延遲並控制成本。在此支援下,基於 NVIDIA DGX Station 平台打造的 XpertStation WS300,作為桌邊型 AI 超級電腦,可用於本地 AI 開發、模型微調及多模型 Agent 工作流程;而採用 NVIDIA DGX Spark 的 EdgeXpert,則將同樣的智慧路由能力應用於精巧機型,支援常駐運行的 AI Agent。
「AI Agent 的每個生命週期階段,都需要不同的系統來支撐,」MSI 微星科技行銷副總經理程惠正表示。「XpertStation WS300 與 EdgeXpert 同步導入 NVIDIA 最新路由與模型技術,讓客戶從模型訓練、微調到常駐部署,都能在同一套生態系統中完成。」
XpertStation WS300:以高容量節點擴展多模型工作流程
MSI XpertStation WS300 採用 NVIDIA GB300 Grace Blackwell Ultra Desktop Superchip,具備高達 748GB 的一致性記憶體(Coherent memory)。此容量讓 Switchyard 得以在本地端同時運行多個模型—包括前沿規模模型與 Nemotron 3.5 Lightning,無需將任何步驟外移至外部基礎設施處理。
透過 NVIDIA ConnectX-8 SuperNIC ,兩台 WS300 可直接連接以應對更大規模的工作負載,同時 PCIe Gen5/Gen6 NVMe 儲存則可確保資料流在持續性多模型工作負載下維持順暢供給。
EdgeXpert:跨多節點擴展Agentic AI
MSI EdgeXpert 基於 NVIDIA DGX Spark 平台打造,採用 NVIDIA GB10 Grace Blackwell Superchip,可提供高達 1 petaFLOP 的 AI 算力,並在精巧機型中搭載 128GB 一致性統一記憶體(Coherent unified memory)。這樣的容量足以讓 Nemotron 3.5 Lightning、甚至參數規模高達 2000 億的模型,在裝置端持續運行,讓專門化、大量的 Agent 任務都能留在本地處理,不必再繞經雲端。
透過 NVIDIA ConnectX-7 networking 網路技術,最多可將四台 EdgeXpert 串接成叢集,隨著 Agent 工作負載成長,進一步擴大 Switchyard 在本地端的模型調度範圍。
NVIDIA NeMo Switchyard與Nemotron 3.5 Lightning
NVIDIA NeMo Switchyard 是專為 AI Agent 設計的開源模型路由函式庫,能自動評估每個工作流程步驟,選出當下最適合的可用模型,不需要事先訓練或人工設定。隨著 Agent 運行次數增加,路由決策也會持續優化。
NVIDIA Nemotron 3.5 Lightning 是輕量化開源模型,蒸餾自 NVIDIA 旗艦模型 Nemotron 3 Ultra,採用混合專家(Mixture-of-experts)架構,總參數量 300 億、活躍參數 30 億,能提供快速且高效的推論表現,並支援最高 100 萬 tokens 的上下文長度,適合與大型模型搭配,作為互補式模型系統長期協同運作。
更多COMPUTEX 2026最新資訊就在 ioioTIME 專區中
現在就加入 ioioTIMES 臉書粉絲團 更多互動、更多好康攏抵加!!
我們有LINE TODAY頻道了,快來追踪我們吧!!--最新科技新聞 盡在你手










