全新輕量級開放式模型與路由函式庫,讓使用者得以在邊緣裝置、P C、工作站、資料中心與雲端環境中,對AI、資料及工作流程擁有更加全面的掌控
隨著人工智慧(AI)從聊天機器人轉向自主代理,
NVIDIA 今日推出 Nemotron 3.5 Lightning,進一步擴展 Nemotron 3 系列模型。這款模型針對長時間運行的代理型 AI 工作負載,提供同級最高的運行效率。此次發布延續 Nemotron 3 Nano,體現 NVIDIA 持續改善開放式模型,以提升準確度與速度的承諾。
Nemotron 3.5 Lightning 是一款擁有 300 億參數的混合專家(mixture-of-experts)模型
此外,NVIDIA 亦推出 NeMo Switchyard,這是一套開源函式庫,
Nemotron 3.5 Lightning 與 NeMo Switchyard 結合後,可讓使用者更精準掌控 AI 的部署方式、執行位置及運作效率,涵蓋 PC、工作站、資料中心與雲端環境。
持續運作的AI代理需要模型系統
現代代理型系統,也就是持續運作的 AI 代理,正日益採用模型系統(systems of models),亦即由多個模型組成的模型組合,
NVIDIA Nemotron 開放模型正是為這類架構而設計。Nemotron 3 Ultra 或 GPT-5.6 等尖端推理模型可負責規劃並協調工作流程,而 Nemotron 3.5 Lightning 等較小型的專用模型,則能執行程式碼審查、工具使用、
Nemotron 3.5 Lightning驅動大量專用任務
NVIDIA Nemotron 3.5 Lightning 是一款可全面客製化的開放模型,專為驅動持續運作 AI 代理的大量任務而打造。其開發亦獲得 Nemotron 聯盟成員的貢獻,包括提供評估方法、推論軟體及資料集,
相較於同級其他模型,Nemotron 3.5 Lightning 的輸出速度最高可提升 4 倍,使代理型任務的完成速度提升 30%。此外,由於其開放且可客製化的特性,Nemotron 3.5 Lightning 可透過 NVIDIA NeMo,輕鬆針對組織自身的領域資料、
各產業的 AI 領導者正針對自身工作負載客製化 Nemotron 3.5 Lightning,包括 CrowdStrike 將其應用於網路安全、Harvey 與 Trajectory 應用於法律服務,以及 CodeRabbit 與 Baseten 應用於程式碼審查,
此外,Lila Sciences 正致力於提升物理科學與生命科學領域中代理型任務的推理能力,而 Fastino Labs 則透過客製化該模型,在軟體開發、
Nemotron 3.5 Lightning 同時讓企業得以掌控隱私與部署。模型可在本地 AI 系統上運行,包括 NVIDIA RTX PC、NVIDIA DGX Spark、NVIDIA DGX Station 及 NVIDIA Jetson,協助使用者充分發揮既有基礎架構投資的效益。Ne
此外,如同每次推出 Nemotron 模型,NVIDIA 都會在授權條款允許的範圍內,盡可能公開訓練資料與技術,
透過模型路由打造更高效的AI應用
有些模型更擅長程式設計,有些適合推理,有些適用於輕量型任務,
NVIDIA NeMo Switchyard 是一套專為 AI 代理打造的開源模型路由函式庫。這項技術會根據特定需求,
NVIDIA 內部基準測試顯示,NeMo Switchyard 能維持前沿模型等級的準確率,同時將完成任務的成本降至單獨使用 Opus 4.8 的近三分之一。
NVIDIA 正與 AI 生態系的合作夥伴共同將智慧模型路由導入開發人員現有的工具與平
● Boomi:針對五項路由功能評估 Switchyard,領域路由準確率達 100%,並將 59% 的流量導向速度快 5 倍的微調模型,同時將後續輪次的延遲降低 21%。
● Cadence:在形式驗證應用情境中使用 ChipStack AI Super Agent,將效率提升 9.9%。
● Classmethod:目前在內部透過 NeMo Switchyard 運行 opencode 與 Fireworks 工作負載,初步測試顯示在維持品質的同時,成本降低 27%。
● Cognition:將 NVIDIA NeMo Switchyard 的分階段路由器整合至 Devin Desktop,供 NVIDIA 內部使用。在 FrontierCode Main 上達到接近前沿模型的效能,
● Kong:透過 Kong AI Gateway 原生提供 NeMo Switchyard 路由功能。
● LangChain:使用 NeMo Switchyard 執行 145 項多輪 Deep Agents 任務時,僅將 7% 的呼叫導向前沿模型,便將成本降低 74%,準確率則只下降 6%。
● LiteLLM:正將 NeMo Switchyard 作為外掛程式形式整合至其 proxy 層,讓開發人員無需更動既有技術堆疊即可享有這些優勢。
● Nous Research:將 NeMo Switchyard 整合至 Hermes,為開發人員提供易於設定的路由系統,
● Ramp:在 Ramp SWE-Bench 測試中,使用 NeMo Switchyard 達到與前沿模型相當的效能,同時將成本降低 58%、執行時間縮短 33%。
● 西門子:正進行基準測試,以提升其 Fuse EDA AI Agent 的效率。
Nemotron 3.5 Lightning 現已於 Hugging Face、ModelScope、OpenRouter 及 build.nvidia.com 上提供,並可作為 NVIDIA NIM 微服務使用。此外,Nemotron 3.5 Lightning 也可透過 NVIDIA 雲端合作夥伴、後訓練平台、
更多COMPUTEX 2026最新資訊就在 ioioTIME 專區中
現在就加入 ioioTIMES 臉書粉絲團 更多互動、更多好康攏抵加!!
我們有LINE TODAY頻道了,快來追踪我們吧!!--最新科技新聞 盡在你手










