智譜AI(Z.ai)的GLM-5.3模型在Artificial Analysis智慧指數上獲得60分,與Kimi K3並列開源模型榜首,比上一代GLM-5.2高出7分。這一成績使GLM-5.3在開源模型中處於領先地位,並接近西方前沿模型水平。

據Artificial Analysis資料,GLM-5.3在代理任務(agentic tasks)上進步最大。在GDPval-AA v2基準測試中,其Elo評分從1,524躍升至1,770,提升246點,排名第二,僅次於Claude Opus 5(1,855分)。這表明GLM-5.3在複雜任務執行和工具呼叫等能力上顯著增強。

價格方面,GLM-5.3每任務成本為0.68美元,比前代GLM-5.2的0.44美元高出1.5倍,但比Kimi K3的0.84美元便宜19%。這一價格策略使其在開源模型中具有競爭力,尤其對成本敏感的開發者具有吸引力。

然而,GLM-5.3的開源權重發布被推遲約兩週。智譜AI表示,由於該模型在檢測安全漏洞方面表現出色,公司決定先加強安全控制,並僅向部分安全合作伙伴開放完整訪問許可權。這一決定反映了AI安全與開源共享之間的平衡考量。

GLM-5.3目前可通過Z.ai的API訪問,開發者已可體驗其能力。開源權重的延遲釋出可能影響部分依賴本地部署的使用者,但公司強調此舉是為了確保安全。

從行業角度看,GLM-5.3的登頂顯示中國開源模型在效能上已與國際領先水平看齊,且價格優勢明顯。不過,安全驅動的釋出延遲也可能引發對開源透明度的討論。未來,開源模型如何在效能、成本與安全之間取得平衡,將是行業持續關注的焦點。