IBM 於 8 月 26 日釋出 Granite 4.2 系列語言模型,提供 3B8B30B 三種引數規模,全部基於約 15 萬億 token 從頭訓練,支援最高 512,000 token 的上下文視窗。該系列模型可在“思考”與“非思考”模式間切換,以控制每項任務的計算量,其中“低功耗”模式可節省簡單查詢的資源消耗。所有模型均以 Apache 2.0 許可證開源,可在 Hugging Face、Ollama、GitHub 等平台獲取。

Granite 4.2 的 8B 和 30B 版本採用了 IBM 所稱的“智慧體強化學習”訓練方法,讓模型在真實沙盒環境中學習使用工具、編寫並執行程式碼以及搜尋網頁。所有模型均支援 OpenAI 格式的工具呼叫,並可在 vLLM 或 SGLang 上執行。IBM 公佈的基準測試結果顯示,30B 模型在智慧體任務和工具使用測試中均領先。

此外,IBM 還發布了 Granite Speech 5.0 Turbo CTC 語音模型,引數量僅 4.7 億,據稱在 Open ASR Leaderboard 上速度是此前領先模型的兩倍,每秒可轉錄三小時音訊。

此次釋出正值開源大模型競爭加劇之際。Meta 的 Llama 系列、Mistral 和 DeepSeek 等開源模型不斷迭代,而 IBM 選擇以 Apache 2.0 許可證釋出,意味著開發者可自由使用、修改甚至商用,無需受限於寬鬆程度較低的許可證。Granite 4.2 的智慧體能力直接對標 Anthropic 的 Claude 和 OpenAI 的 GPT 系列中強調工具使用的模型,但 IBM 通過開源策略試圖在企業市場建立差異化優勢。

對於企業使用者而言,Granite 4.2 的本地部署能力和可控的計算開銷可能具有吸引力,尤其是需要處理長文件或複雜工作流的場景。不過,模型的實際效能仍需第三方評測驗證,且 30B 規模在推理成本上可能高於更小的模型。IBM 此舉也反映了其從傳統軟體向 AI 平台轉型的戰略,但能否在競爭激烈的市場中佔據一席之地,仍有待觀察。