輝達於8月11日宣佈擴充套件其Nemotron 3模型系列,推出名為Nemotron 3.5 Lightning的新模型,旨在加速智慧體AI工作負載。據官方介紹,與同類其他模型相比,該模型的輸出速度最高可提升4倍,智慧體任務完成速度可提升30%。輝達將其稱為“同類模型中針對長時間執行的智慧體AI工作負載效率最高的模型”。

Nemotron 3.5 Lightning是一款擁有300億引數的混合專家模型,這種架構通常能在保持高效能的同時降低計算成本。輝達表示,該模型可幫助開發者構建更智慧、更高效的智慧體應用,例如需要長時間執行、多步驟推理的AI代理系統。

目前,Nemotron 3.5 Lightning已作為輝達NIM微服務在多個平台上線,包括Hugging FaceModelScopeOpenRouter以及輝達自家的build.nvidia.com。這意味著開發者可以快速整合該模型,而無需自行部署底層基礎設施。

此次釋出正值智慧體AI成為行業熱點之際。各大科技公司紛紛推出能自主執行任務的AI代理,而推理速度和效率成為實際部署中的關鍵瓶頸。輝達此次強調“長時間執行”場景,暗示其針對的是需要持續互動、多輪決策的複雜任務,而非簡單的單次查詢。

從市場角度看,輝達在AI晶片領域的主導地位已使其成為算力基礎設施的核心供應商,而此次推出高效模型,可能進一步鞏固其在AI軟體生態中的影響力。不過,該模型的實際表現仍需開發者測試驗證,其與競爭對手模型的優劣對比也尚待第三方基準評測。對於關注AI應用落地的投資者而言,該模型的採用情況或可作為觀察智慧體AI商業化程序的一個視窗。