The Decoder 最新一期《前沿雷達》第4期指出,中國AI模型已逼近美國頂尖水平,西方實驗室雖歸咎於蒸餾技術,但結論是:模型領先優勢已無法防守。該期以“中國已追上,西方AI領先還剩什麼?”為主題,深入剖析了當前格局。

一年半前,DeepSeek R1 的釋出曾引發市場震動,中國實驗室以更低成本挑戰 OpenAI 的 o1 推理模型,導致美股蒸發數十億美元。但當時中國模型僅在個別測試中領先,整體仍落後。如今,Moonshot 的 Kimi K3阿里的 Qwen3.8-MaxGLM-5.3 等最新開源模型,已在幾乎所有廣泛、嚴苛的評測中躋身前列,處理長知識任務、多步驟程式設計和工具協調能力大幅提升。

據《華爾街日報》報道,Anthropic 在即將進行的 IPO 前面臨投資者質疑,其辯護理由僅剩頂尖模型的領先優勢。而在此之下,市場主要由中國開源且價格低廉的模型主導。投資者擔憂,單純模型效能已難以支撐商業模式,因為獨家功能數月後就會被免費模型複製。

文章指出,美國領先優勢並未消失,但已退縮到“前沿”的少數狹窄領域。三大領域仍具優勢:第一,抽象專項測試,如 ARC-AGI-2 上,Anthropic 的 Opus 5 得分 89.2%,遠超 Kimi K3 的 60.4%,但該測試與日常任務脫節,經濟意義存疑。第二,可靠性,在 AA-AnalystAgent 基準中,Opus 5 以 54% 的通過率領先,GPT-5.5 為 50%,K3 為 39%,差距主要源於重複性不足。第三,系統生態,即持續產出新模型的整體體系,而非單一模型。

文章認為,模型本身已難構成護城河,領先優勢正轉向圍繞模型的系統。同時,歐洲在AI競賽中同時輸掉兩場:既未孕育出頂尖模型,也未形成有競爭力的生態系統。該期還探討了蒸餾技術的證據、benchmaxxing 現象,以及中國模型在 token 消耗上的劣勢。整體而言,西方AI的領先地位正從模型層轉向系統層,而中國已在這一轉變中佔據有利位置。