Nvidia發布開源AI代理模型 Nemotron 3.5 Lightning

台灣產經新聞網/台灣產經新聞網 新聞中心
14 小時前

【新聞中心/綜合外電】Nvidia 於週二發布了 Nemotron 3.5 Lightning,這是一款專為企業應用打造的免費開源 AI 模型,可在單一 GPU 上運行,同時也推出了名為 NeMo Switchyard 的全新模型路由工具,旨在降低 AI 工作負載的成本。

此次發布是 Nvidia 自執行長黃仁勳於七月下旬在 X 平台發表公開信以來,首度推出開源模型。黃仁勳在信中為開放式 AI 模型辯護,並呼籲美國政府避免實施可能將創新推向海外的限制措施。

輝達推開源模型 搶攻企業AI代理市場

輝達(NVIDIA)於美東時間11日發表全新開源AI模型「Nemotron 3.5 Lightning」,並同步推出模型路由工具「NeMo Switchyard」,瞄準企業級AI代理(AI agents)應用場景。輝達表示,這款300億參數的混合專家(MoE)模型,可在單一GPU上運行,輸出速度較同級開源模型快達4倍,代理任務完成時間縮短30%,鎖定高頻率、專門化任務需求。

輕量化設計 單卡即可部署

輝達生成式AI軟體副總裁卡莉·布里斯基(Kari Briski)向《華爾街日報》表示,Nemotron 3.5 Lightning「非常容易客製化」。她舉例,程式碼審查平台CodeRabbit僅用輝達標準訓練流程,耗資約85美元、花費兩小時,即可完成路由代理模型建置。該模型可運行於RTX PC、DGX Spark及Jetson等邊緣裝置,並能擴展至資料中心與雲端環境,提供企業從邊緣到雲端的完整部署彈性。

路由技術降本增效 合作夥伴實測有感

與Lightning同步發表的NeMo Switchyard,為開源模型路由函式庫,可依據品質、延遲與成本,自動將AI代理請求導向最適合的模型。輝達內部測試顯示,Switchyard在維持前沿模型準確度的同時,將任務完成成本降至僅使用單一前沿模型的三分之一。

合作夥伴實測數據更具說服力。支付平台Ramp表示,使用Switchyard後,在Ramp SWE-Bench基準測試中達成與前沿模型相當的表現,同時降低成本58%、執行時間縮短33%。AI開發平台LangChain則透過將僅7%的呼叫路由至前沿模型,實現整體成本降低74%。輝達指出,已有九家企業參與Switchyard測試,包括Cognition、CrowdStrike及Harvey等,均回報顯著的成本效益提升。

黃仁勳首發聲 力挺開源AI生態

此次發布正值輝達執行長黃仁勳(Jensen Huang)高調支持開源AI模型之際。今年7月,黃仁勳在社群平台X發表首篇文章,分享由輝達、微軟、Meta等25家科技企業聯署的公開信,呼籲美國政府支持開源權重AI模型,避免過早限制導致創新外移。

黃仁勳在公開信中強調:「開放模型能強化安全與網路安全、加速創新與扩散,並賦予主權能力。世界需要前沿封閉模型與前沿開放模型並存。」分析認為,輝達此次推出開源模型,除技術佈局外,亦具明確商業策略意圖。黃仁勳上月接受Axios訪問時直言:「免費AI對硬體應該是好事,免費AI對晶片應該是好事。」

開源軍備競賽升溫 輝達搶佔先機

輝達此舉被視為對Meta等競爭對手的回應。就在輝達發布前一日,Meta執行長祖克柏(Mark Zuckerberg)發表公開文章倡議開源AI,並同步推出新款程式碼模型。市場觀察,隨著中國Kimi K3等模型引發華府對知識產權竊取的擔憂,全球開源AI軍備競賽正持續升溫。

Nemotron 3.5 Lightning目前已上架Hugging Face、ModelScope、OpenRouter及輝達官方平台。據《The Information》報導,輝達已著手開發下一代Nemotron 4模型,持續鞏固其在企業AI市場的領導地位。

 

*圖片為 AI生成示意圖,圖文歡迎轉載引用,請標註來源。