8月6日,独立评测机构Artificial Analysis公布最新智能体能力(Agentic Index)排行榜,阿里巴巴的Qwen3.8-Max以55.4分位列全球第一,超越Claude Opus5和GPT5.6。这是中国模型首次在该榜单登顶,此前最好成绩是Kimi K3的50.1分。
Agentic智能体能力衡量的是AI调用工具、自主解决复杂问题的潜力,被视为AI从对话走向实际应用的关键指标。这一领域长期由Claude、GPT等海外模型主导,中国模型此前在Agentic维度上始终处于追赶状态。此次阿里Qwen3.8-Max的登顶,意味着中国模型在智能体这一前沿方向上实现了对海外头部产品的反超。
Artificial Analysis是业内常用的模型评测平台,其Agentic Index榜单综合考察模型在工具调用、任务规划等维度的表现。阿里此次夺冠,可能反映出其在Agentic技术路线上的投入已初见成效。不过,榜单排名会随模型迭代和评测标准调整而变化,后续竞争仍存在不确定性。对于关注AI产业格局的投资者而言,这一事件显示中国大模型在关键能力维度上已具备与国际顶尖模型正面竞争的实力。