智谱AI(Z.ai)的GLM-5.3模型在Artificial Analysis智能指数上获得60分,与Kimi K3并列开源模型榜首,比上一代GLM-5.2高出7分。这一成绩使GLM-5.3在开源模型中处于领先地位,并接近西方前沿模型水平。
据Artificial Analysis数据,GLM-5.3在代理任务(agentic tasks)上进步最大。在GDPval-AA v2基准测试中,其Elo评分从1,524跃升至1,770,提升246点,排名第二,仅次于Claude Opus 5(1,855分)。这表明GLM-5.3在复杂任务执行和工具调用等能力上显著增强。
价格方面,GLM-5.3每任务成本为0.68美元,比前代GLM-5.2的0.44美元高出1.5倍,但比Kimi K3的0.84美元便宜19%。这一价格策略使其在开源模型中具有竞争力,尤其对成本敏感的开发者具有吸引力。
然而,GLM-5.3的开源权重发布被推迟约两周。智谱AI表示,由于该模型在检测安全漏洞方面表现出色,公司决定先加强安全控制,并仅向部分安全合作伙伴开放完整访问权限。这一决定反映了AI安全与开源共享之间的平衡考量。
GLM-5.3目前可通过Z.ai的API访问,开发者已可体验其能力。开源权重的延迟发布可能影响部分依赖本地部署的用户,但公司强调此举是为了确保安全。
从行业角度看,GLM-5.3的登顶显示中国开源模型在性能上已与国际领先水平看齐,且价格优势明显。不过,安全驱动的发布延迟也可能引发对开源透明度的讨论。未来,开源模型如何在性能、成本与安全之间取得平衡,将是行业持续关注的焦点。