9月2日,阿里巴巴更新了其旗艦大模型Qwen3.8-Max,新版本在程式設計與專業辦公場景下經過專項後訓練,整體效能顯著增強。在聚焦前端程式設計能力(WebDev)的全球權威三方榜單CodeArena中,Qwen3.8-Max新版本得分提升22分至1691分,超越Claude Opus5、Kimi K3等一眾模型,位居總榜第一。
CodeArena同時更新的模型價效比榜單(帕累託前沿)顯示,Qwen3.8-Max新版本每百萬Tokens綜合平均成本僅為5美元,在效能與成本之間取得了較好平衡。目前,該新模型已上線千問AI平台對外提供API服務,千問辦公、Qoder、千問APP均第一時間完成接入。
此次更新體現了阿里在大模型領域的持續投入。前端程式設計能力是衡量模型實際應用價值的重要指標,登頂CodeArena意味著Qwen3.8-Max在程式碼生成、網頁開發等任務上已達到國際領先水平。同時,低至5美元/百萬Tokens的定價,也使其在商業化落地中更具競爭力。
對於關注AI行業的投資者而言,阿里旗艦模型的效能突破與成本優勢,可能進一步加劇大模型市場的競爭,並影響相關企業的技術路線與定價策略。不過,榜單成績僅反映特定測試場景下的表現,實際應用效果仍需結合具體業務驗證。