8 月 7 日,OpenAI 宣佈 ChatGPT 每週活躍使用者達到 10 億,同時將 GPT-5.6 Luna 開放給免費使用者,文本對話不限次數。而就在前一天,多名 DeepSeek API 使用者收到通知,公司計劃近期整體上調 API 服務價格,預計漲幅較大,具體價格和執行時間待後續公告。一升一降之間,大模型行業的攻守態勢正在發生微妙變化。
OpenAI 的免費策略並非慈善。GPT-5.6 Luna 定位中等能力區間,足以應對日常對話、簡單寫作和基礎翻譯,但複雜推理和多步驟程式碼分析仍需更高階的 SOL 系列。OpenAI 用一款“夠用就好”的模型覆蓋最廣的使用者場景,其底氣來自成本端的快速下降:過去 18 個月,大模型推理的單位 Token 成本曲線陡峭下滑,模型架構最佳化、量化技術成熟和推理引擎升級,使同樣算力叢集能服務的請求量是兩年前的幾十倍。當邊際成本足夠低,免費就接近谷歌搜尋的邏輯——入口免費,生態收錢。
然而,免費策略的代價同樣清晰。2026 年一季度,OpenAI 收入 57 億美元,非 GAAP 經營虧損率 -122%,每賺 1 美元要倒貼 1.22 美元,全年預計淨虧 140 億美元。10 億周活中,付費訂閱者僅 5000 萬,付費率約 5%。訂閱費顯然無法支撐公司運營,收入來源正在轉向廣告和企業服務:廣告業務上線 6 周即達到 1 億美元年化收入;企業 API 持續擴張,Codex 每週 500 萬用戶,企業客戶貢獻超過 40% 的收入。ChatGPT 的商業模型正從“賣模型訂閱”切換為“收平台稅”——模型免費,靠廣告、企業服務和開發者生態變現。
DeepSeek 的處境則完全不同。其 V4 Flash 模型在 OpenRouter 全球呼叫量周榜登頂,單週處理 7.22 萬億 Token,據 OpenCode 資料,僅 8 月 1 日單日處理量就達 8 萬億 Token。工作日高峰時段介面超時和卡頓頻發,7 月中旬已推出峰谷定價機制(高峰翻倍),8 月 6 日直接預告全面大幅漲價。根本原因是使用者太多、算力不足:過低的定價吸引了大量低頻次、低付費意願的呼叫,伺服器資源被無效請求擠佔,真正需要深度推理的企業和開發者反而得不到穩定體驗。DeepSeek 需要把“拿 AI 當玩具”的使用者擋在門外,讓願意為高質量推理付費的人留下來。
這一邏輯與豆包 6 月 24 日上線付費版(68/200/500 元三檔月費,基礎功能保持免費)如出一轍。豆包擁有 3.45 億月活,日均消耗數千萬元推理成本,電商佣金難以彌補。國內大模型競賽白熱化,融資環境轉冷,算力不足始終是緊箍咒,過去靠資本續命、無限補貼的打法難以為繼,證明自己能賺錢比證明技術領先更緊迫。當然,漲價不意味放棄價格優勢,更準確的說法是價格戰的冷啟動階段結束——此前任務是“讓使用者用得上”,現在變成“讓使用者願意為好東西付錢”。
從 GPT-4 時代比拼模型能力,到 GPT-5.6 Luna 階段頂尖模型差距縮小,競爭正從“誰更聰明”轉向“誰更離不開”。OpenAI 選擇免費,賭的是使用者時長和入口地位,要成為大多數人接觸 AI 的預設方式;中國廠商提價或推付費版,則是在資本退潮和算力管制下尋找商業閉環,不再滿足於“使用者很多但不賺錢”。方向相反,焦慮對稱:OpenAI 要在融資視窗關閉前證明平台稅能覆蓋推理成本,中國公司要在算力見頂前把使用者規模變成可持續收入。
這場分化可能形成三層結構:最底層是日常對話和通用問答,模型能力溢位、成本極低,免費成為常態;中間層是專業推理(程式碼、資料分析、法律、醫療),使用者願為結果付費,DeepSeek 和豆包的付費版主攻此層;最上層是 Agent 執行,AI 直接替使用者完成操作,收費模式從按 Token 計費轉向按成果計費。不計成本的免費時代正在結束,留下來的免費,都是算得過賬的生意。