英伟达于8月11日宣布扩展其Nemotron 3模型系列,推出名为Nemotron 3.5 Lightning的新模型,旨在加速智能体AI工作负载。据官方介绍,与同类其他模型相比,该模型的输出速度最高可提升4倍,智能体任务完成速度可提升30%。英伟达将其称为“同类模型中针对长时间运行的智能体AI工作负载效率最高的模型”。

Nemotron 3.5 Lightning是一款拥有300亿参数的混合专家模型,这种架构通常能在保持高性能的同时降低计算成本。英伟达表示,该模型可帮助开发者构建更智能、更高效的智能体应用,例如需要长时间运行、多步骤推理的AI代理系统。

目前,Nemotron 3.5 Lightning已作为英伟达NIM微服务在多个平台上线,包括Hugging FaceModelScopeOpenRouter以及英伟达自家的build.nvidia.com。这意味着开发者可以快速集成该模型,而无需自行部署底层基础设施。

此次发布正值智能体AI成为行业热点之际。各大科技公司纷纷推出能自主执行任务的AI代理,而推理速度和效率成为实际部署中的关键瓶颈。英伟达此次强调“长时间运行”场景,暗示其针对的是需要持续交互、多轮决策的复杂任务,而非简单的单次查询。

从市场角度看,英伟达在AI芯片领域的主导地位已使其成为算力基础设施的核心供应商,而此次推出高效模型,可能进一步巩固其在AI软件生态中的影响力。不过,该模型的实际表现仍需开发者测试验证,其与竞争对手模型的优劣对比也尚待第三方基准评测。对于关注AI应用落地的投资者而言,该模型的采用情况或可作为观察智能体AI商业化进程的一个窗口。