9月2日,阿里巴巴更新了其旗舰大模型Qwen3.8-Max,新版本在编程与专业办公场景下经过专项后训练,整体性能显著增强。在聚焦前端编程能力(WebDev)的全球权威三方榜单CodeArena中,Qwen3.8-Max新版本得分提升22分至1691分,超越Claude Opus5、Kimi K3等一众模型,位居总榜第一。
CodeArena同时更新的模型性价比榜单(帕累托前沿)显示,Qwen3.8-Max新版本每百万Tokens综合平均成本仅为5美元,在性能与成本之间取得了较好平衡。目前,该新模型已上线千问AI平台对外提供API服务,千问办公、Qoder、千问APP均第一时间完成接入。
此次更新体现了阿里在大模型领域的持续投入。前端编程能力是衡量模型实际应用价值的重要指标,登顶CodeArena意味着Qwen3.8-Max在代码生成、网页开发等任务上已达到国际领先水平。同时,低至5美元/百万Tokens的定价,也使其在商业化落地中更具竞争力。
对于关注AI行业的投资者而言,阿里旗舰模型的性能突破与成本优势,可能进一步加剧大模型市场的竞争,并影响相关企业的技术路线与定价策略。不过,榜单成绩仅反映特定测试场景下的表现,实际应用效果仍需结合具体业务验证。