8月6日,獨立評測機構Artificial Analysis公佈最新智慧體能力(Agentic Index)排行榜,阿里巴巴的Qwen3.8-Max以55.4分位列全球第一,超越Claude Opus5和GPT5.6。這是中國模型首次在該榜單登頂,此前最好成績是Kimi K3的50.1分。
Agentic智慧體能力衡量的是AI呼叫工具、自主解決複雜問題的潛力,被視為AI從對話走向實際應用的關鍵指標。這一領域長期由Claude、GPT等海外模型主導,中國模型此前在Agentic維度上始終處於追趕狀態。此次阿里Qwen3.8-Max的登頂,意味著中國模型在智慧體這一前沿方向上實現了對海外頭部產品的反超。
Artificial Analysis是業內常用的模型評測平台,其Agentic Index榜單綜合考察模型在工具呼叫、任務規劃等維度的表現。阿里此次奪冠,可能反映出其在Agentic技術路線上的投入已初見成效。不過,榜單排名會隨模型迭代和評測標準調整而變化,後續競爭仍存在不確定性。對於關注AI產業格局的投資者而言,這一事件顯示中國大模型在關鍵能力維度上已具備與國際頂尖模型正面競爭的實力。