Anthropic 于周五(7 月 24 日)正式发布其旗舰级大模型 Opus 5,这是该系列自 5 月 28 日 Opus 4.8 发布仅两个月后的又一次重大升级。与 Anthropic 此前推出的最强模型 Fable 5 相比,Opus 5 在多个关键维度上展现出显著优势。

尽管 Opus 5 的模型规模小于 Fable 5,但其在多项基准测试中反而实现了 性能超越。Anthropic 在公告中强调,Opus 5 “在验证自身工作并迭代直至成功方面远强于以往”,并举例称该模型能根据不完整的提示自主编写计算机视觉管线。这一表现使得 Opus 5 在多数使用场景下比 Fable 5 更具吸引力,同时其 定价更低、使用限制更少。

在安全与隐私方面,Opus 5 延续了其前代产品的宽松政策:与 Fable 和 Mythos 不同,Opus 系列不受 30 天数据保留政策 的约束,这一政策此前曾引发部分注重隐私用户的担忧。不过,Opus 5 仍保留了针对网络安全任务(如漏洞利用生成和渗透测试)的实质性防护措施。例如,模型被禁止用于扫描软件二进制文件中的漏洞,但允许在源代码中搜索漏洞,因为后者更可能用于防御目的。Anthropic 预计,Opus 5 的安全分类器触发频率将比 Fable 5 降低约 85%,反映出对能力较弱模型更宽松的管控策略。

为减少安全措施对用户体验的干扰,Anthropic 还推出了名为 Automatic Fallbacks 的测试版功能。用户可主动启用该功能,当提示词触发安全分类器时,系统会自动将请求路由至能力较弱的模型,从而返回功能性响应而非错误信息。这一设计旨在平衡安全需求与 API 调用的连续性。

值得注意的是,Opus 5 的发布紧随 Anthropic 在 6 月推出的 Mythos 5、Fable 5 和 Sonnet 5 之后,目前仅剩轻量级模型 Haiku 尚未升级至 5 系列。Anthropic 正以密集节奏更新其产品线,Opus 5 的快速迭代表明该公司正加速巩固其在高端大模型市场的地位。

从行业视角看,Opus 5 的“更强、更便宜、更开放”策略可能对竞争对手形成压力。SpaceXAI(原 xAI)的 Grok 系列、OpenAI 的 GPT 系列以及 Google 的 Gemini 系列均面临类似挑战:如何在提升性能的同时降低使用门槛。Anthropic 通过 Opus 5 展示了在模型能力与实用性之间取得新平衡的可能性,这或将成为大模型竞争的下一个焦点。