8月13日凌晨,DeepSeek V4 Pro正式釋出,為開源模型生態再添一把火。此前,Kimi K3MiniMax H3DeepSeek V4 flash等中國開源模型接連登場,形成猛攻之勢,令美國AI公司罕見地感受到壓力。輝達CEO黃仁勳甚至親自發布其人生第一條推文,呼籲全行業共同推動美國開源生態發展。目前,除Anthropic外,美國AI圈主要玩家幾乎全員加入這一聯盟,OpenAISam Altman谷歌Sundar Pichai等閉源模型掌門人也罕見發文表示支援。

為何平時競爭激烈的公司這次站到同一戰線?Anthropic又為何堅持不加入?要理解這些,需先釐清“開源模型”到底開放了什麼。

一個大模型從訓練到釋出,大致可分為七個環節:訓練資料模型架構與引數規模訓練基礎設施訓練流程與Checkpoint模型權重模型部署以及技術報告。其中,模型權重是訓練後引數形成的集合,記錄模型學到的知識,是核心成果。

按開放程度,模型可分為閉源開放權重完全開源三類。閉源模型如Anthropic、OpenAI、谷歌的大部分模型,所有環節均不對外開放;完全開源如Ai2的OLMo系列,從資料到程式碼全部公開;而目前多數所謂的“開源模型”實為開放權重(Open Weight),即只公開模型權重和推理程式碼,允許下載、微調,但訓練資料、完整訓練流程等核心仍保密。

不同開放權重模型開放程度差異顯著。Meta的Llama系列是基礎開放權重的代表,但訓練資料配方、內部工具鏈等從不公開,且其許可證限制較多,如月活超7億需額外授權、禁止用Llama輸出訓練其他大模型等。而DeepSeek之所以震撼行業,在於它不僅詳細公開技術報告,還開源了內部工程工具鏈,如DeepEPFlashMLA等,堪稱“開放權重的Plus版”。Kimi K3也延續此做法,同步開放了MoonEPFlashKDAAgentEnv三大自研基礎設施,分別解決通訊、計算、訓練環境等卡點。

許可證是決定開發者能否商用、修改、再發布的關鍵。過去一年,中國模型廠商的許可證明顯更開放:DeepSeek已全面採用MIT License,阿里Qwen切換至Apache 2.0,並計劃首次開源旗艦模型Qwen3.8-Max的權重;智譜GLM自2025年起使用MIT。Kimi K3則啟用全新的Kimi K3 License,雖對多數開發者與MIT差別不大,但設定了門檻:月活超1億或月收入超2000萬美元的產品需顯著展示標識;模型即服務(MaaS)託管業務連續12個月收入超2000萬美元需另行簽約。

開放權重並不等於放棄商業化。企業下載模型後,仍需算力、運維、定製開發等服務,因此開源可帶動多種收入:一是通過開放模型帶動雲端計算和基礎設施消費,如阿里雲;二是提供私有化部署和行業定製服務;三是提供收費的後訓練和模型開發平台。此外,MaaS廠商和雲廠商也需按許可證向模型公司付費。Moonshot AI(Kimi母公司)當前年化經常性收入(ARR)已達約3億美元

對企業和整個AI生態而言,開放權重意義重大。過去最強模型多為閉源,能力集中在少數公司手中;開放權重讓前沿模型可被下載、部署、微調,促進創新。對企業,開源模型成本更低,且可自主掌控,不必依賴外部API。一種主流做法是:困難任務用最強閉源模型,日常任務用中國開放權重模型。

此次美國AI巨頭罕見聯手,反映中國開源模型的衝擊已不容忽視。而Anthropic的缺席,或許與其閉源商業模式直接相關。開源與閉源之爭,正深刻重塑AI行業格局。