IBM 于 8 月 26 日发布 Granite 4.2 系列语言模型,提供 3B、8B 和 30B 三种参数规模,全部基于约 15 万亿 token 从头训练,支持最高 512,000 token 的上下文窗口。该系列模型可在“思考”与“非思考”模式间切换,以控制每项任务的计算量,其中“低功耗”模式可节省简单查询的资源消耗。所有模型均以 Apache 2.0 许可证开源,可在 Hugging Face、Ollama、GitHub 等平台获取。
Granite 4.2 的 8B 和 30B 版本采用了 IBM 所称的“智能体强化学习”训练方法,让模型在真实沙盒环境中学习使用工具、编写并运行代码以及搜索网页。所有模型均支持 OpenAI 格式的工具调用,并可在 vLLM 或 SGLang 上运行。IBM 公布的基准测试结果显示,30B 模型在智能体任务和工具使用测试中均领先。
此外,IBM 还发布了 Granite Speech 5.0 Turbo CTC 语音模型,参数量仅 4.7 亿,据称在 Open ASR Leaderboard 上速度是此前领先模型的两倍,每秒可转录三小时音频。
此次发布正值开源大模型竞争加剧之际。Meta 的 Llama 系列、Mistral 和 DeepSeek 等开源模型不断迭代,而 IBM 选择以 Apache 2.0 许可证发布,意味着开发者可自由使用、修改甚至商用,无需受限于宽松程度较低的许可证。Granite 4.2 的智能体能力直接对标 Anthropic 的 Claude 和 OpenAI 的 GPT 系列中强调工具使用的模型,但 IBM 通过开源策略试图在企业市场建立差异化优势。
对于企业用户而言,Granite 4.2 的本地部署能力和可控的计算开销可能具有吸引力,尤其是需要处理长文档或复杂工作流的场景。不过,模型的实际性能仍需第三方评测验证,且 30B 规模在推理成本上可能高于更小的模型。IBM 此举也反映了其从传统软件向 AI 平台转型的战略,但能否在竞争激烈的市场中占据一席之地,仍有待观察。