Anthropic 正在内部使用一款名为“Model 2”的未发布 AI 模型,其综合能力超过所有公开版本的 Claude。这一信息来自 Anthropic 于 2026 年 8 月发布的风险报告。报告将“Model 2”归类为“Mythos 级”,并指出其整体性能“略强于”Claude Mythos 5,但在某些方面表现较弱。值得注意的是,Anthropic 表示,该模型并未展现出类似从 Opus 4.6 到 Mythos 那样的巨大能力跃升。
在 Anthropic 的内部能力指数(AECI)上,“Model 2”比 Mythos 5 高出约 1.5 点,这一增幅小于从 Mythos Preview 到 Mythos 5 的跳跃。AECI 是 Anthropic 内部基准测试的集合,用于衡量模型能力。
据报道,Anthropic 内部高度依赖“Model 2”进行编码、数据生成以及研究与工程工作,有时通过持续运行的智能体(agent)来执行任务。目前,Claude 已经编写了 Anthropic 生产系统中的大部分代码。
在部署前,“Model 2”经过了内部审查,但其测试的彻底性不如 Mythos 5。Anthropic 表示,在审查过程中未发现新的或更令人担忧的错位问题,并将整体错位风险评为“低”。
目前,Anthropic 没有计划对外发布“Model 2”。这一消息由科技媒体 The Decoder 于 2026 年 8 月 20 日报道。
对于关注 AI 行业的观察者而言,这一动态表明 Anthropic 的内部研发可能领先于其公开产品线,同时也反映了前沿实验室在模型安全评估与部署策略上的谨慎态度。尽管“Model 2”性能更强,但 Anthropic 选择不立即发布,可能出于安全、竞争或产品规划等多重考虑。