英偉達(NVDA)通過發佈Nemotron 3.5 Lightning並推進萬億參數的Nemotron 4系列,正加速從AI芯片供應商向開源模型生態建設者延伸。這一戰略的核心邏輯在於以模型普及帶動算力需求,儘管面臨與客戶及被投企業的競爭、且當前模型性能仍落後於全球最前沿,但Nemotron 4的成敗將決定英偉達能否構建覆蓋硬件、軟件和模型的完整AI技術棧,從而在長期維持其GPU市場的增長動力。
Nemotron 3.5 Lightning是一款擁有300億參數的混合專家模型,主要用於幫助開發者構建更加智能且高效的AI智能體應用。英偉達將其稱為同類產品中針對長時間運行AI智能體工作負載效率最高的模型。
與傳統聊天機器人主要圍繞單次問答不同,AI智能體通常需要執行多步驟推理、調用不同工具並持續完成複雜任務,因此模型運行效率、推理成本以及不同模型之間的調度能力變得更加重要。英偉達希望通過Nemotron 3.5 Lightning進一步切入這一快速增長的應用場景。
與此同時,公司還同步推出開源庫NeMo Switchyard,為主流AI智能體工具提供智能模型路由功能。企業可以根據自身需求建立專屬路由系統,部署完成後,NeMo Switchyard能夠根據不同任務,將請求自動發送給能力和特性更加匹配的AI模型,同時無需開發人員重新編寫現有應用程序。英偉達表示,Nemotron 3.5 Lightning與NeMo Switchyard結合後,可以讓企業更加靈活地控制AI如何部署、在哪裡運行以及以何種效率運行,覆蓋PC、工作站、數據中心和雲端等不同計算環境。
除了Nemotron 3.5 Lightning之外,英偉達還在推進規模和性能更加激進的下一代Nemotron 4系列。據The Information援引多名參與Nemotron項目的人士報道,英偉達希望該系列中規模最大的模型在性能上能夠與全球最優秀的開源AI模型競爭。多名參與項目的員工預計,最大的Nemotron 4模型將至少擁有1萬億參數,約為英偉達今年6月推出的Nemotron 3 Ultra參數規模的兩倍。目前Nemotron 4的最終規格和發佈時間尚未確定,報道稱最終訓練尚未開始,而這一過程本身可能需要數月時間,有員工預計該模型最快可能在今年秋季晚些時候準備就緒。
今年3月,英偉達成立了Nemotron Coalition,與全球多家領先AI實驗室合作開發開源前沿模型。公司當時表示,該聯盟共同打造的首個模型將成為未來Nemotron 4開源模型系列的基礎。英偉達生成式AI副總裁Kari Briski表示,公司投資Nemotron,是因為其認為每一家企業、每一個國家都需要能夠獲取的前沿開源模型,以增強安全性、加快創新,並提供可以跨越不同技術世代持續使用的基礎。