The Decoder 最新一期《前沿雷达》第4期指出,中国AI模型已逼近美国顶尖水平,西方实验室虽归咎于蒸馏技术,但结论是:模型领先优势已无法防守。该期以“中国已追上,西方AI领先还剩什么?”为主题,深入剖析了当前格局。

一年半前,DeepSeek R1 的发布曾引发市场震动,中国实验室以更低成本挑战 OpenAI 的 o1 推理模型,导致美股蒸发数十亿美元。但当时中国模型仅在个别测试中领先,整体仍落后。如今,Moonshot 的 Kimi K3阿里的 Qwen3.8-MaxGLM-5.3 等最新开源模型,已在几乎所有广泛、严苛的评测中跻身前列,处理长知识任务、多步骤编程和工具协调能力大幅提升。

据《华尔街日报》报道,Anthropic 在即将进行的 IPO 前面临投资者质疑,其辩护理由仅剩顶尖模型的领先优势。而在此之下,市场主要由中国开源且价格低廉的模型主导。投资者担忧,单纯模型性能已难以支撑商业模式,因为独家功能数月后就会被免费模型复制。

文章指出,美国领先优势并未消失,但已退缩到“前沿”的少数狭窄领域。三大领域仍具优势:第一,抽象专项测试,如 ARC-AGI-2 上,Anthropic 的 Opus 5 得分 89.2%,远超 Kimi K3 的 60.4%,但该测试与日常任务脱节,经济意义存疑。第二,可靠性,在 AA-AnalystAgent 基准中,Opus 5 以 54% 的通过率领先,GPT-5.5 为 50%,K3 为 39%,差距主要源于重复性不足。第三,系统生态,即持续产出新模型的整体体系,而非单一模型。

文章认为,模型本身已难构成护城河,领先优势正转向围绕模型的系统。同时,欧洲在AI竞赛中同时输掉两场:既未孕育出顶尖模型,也未形成有竞争力的生态系统。该期还探讨了蒸馏技术的证据、benchmaxxing 现象,以及中国模型在 token 消耗上的劣势。整体而言,西方AI的领先地位正从模型层转向系统层,而中国已在这一转变中占据有利位置。