7 月 15 日,一款名為 Kivine 的匿名模型悄然出現在 LMArena 競技場,短短數小時內便成為全球 AI 社群焦點。眾多測試者根據其表現猜測,這很可能就是月之暗面尚未正式釋出的下一代旗艦模型 Kimi K3。儘管月之暗面並未公開確認,但一系列線索正逐漸拼湊出一幅完整的釋出前圖景。

Kivine 的曝光始於 X 使用者 @lentils80 的一條推文,他注意到 LMArena 上出現了一個新模型,並直言“Kimi K3 is already on LMArena under the stealth name Kivine”。這一說法迅速傳播,因為 Kivine 在長上下文處理上的表現與 Kimi 系列的技術路線高度吻合。多名使用者測試後反饋,Kivine 擁有 1M context(百萬 token 上下文),在長程任務中表現更佳。百萬 token 上下文正是外界對 Kimi K3 的最大期待之一,它意味著模型能一次性處理整套企業資料、數十萬字研究報告或大型軟體專案程式碼,這符合月之暗面從 Kimi 早期長文本優勢到 K2 推理能力的演進路徑。

除了長上下文,Kivine 的生成質量也備受矚目。測試使用者 @synthwavedd 表示其輸出質量已接近“Fable level”,後者被認為對應 Anthropic 頂級模型水平。有測試案例顯示,Kivine 能完成包含中世紀城堡、森林環境、光影效果及尋寶機制的小遊戲製作,展現出複雜任務執行能力。然而,其響應速度成為明顯短板——一次完整生成可能需要等待約 35 分鐘,這暗示其採用了高強度推理模式,追求極致質量而非即時響應。這種取捨在 OpenAI、Anthropic 的頂級推理模型中同樣存在,但對普通消費者而言,等待數十分鐘顯然不現實,其商業價值或更多體現在科研、軟體開發、企業分析等專業領域。

與此同時,Kimi K3 的產品資訊也開始洩露。7 月 14 日晚,一張“Kimi K3 釋出限時充值活動”的截圖在圈內流傳,但頁面很快被撤下。隨後,網友通過抓包發現 beta.kimi.link 後台已出現 K3 相關模型資訊,顯示產品體系可能已完成重新劃分:K3 被置於預設位置負責複雜任務,K3 Agent 叢集對應自動化能力,而 K2.6 則被重新定位為快速響應模型。這透露出月之暗面未來的產品策略——從“誰回答得更聰明”轉向“誰能夠真正完成工作”,通過多模型分工與 Agent 系統執行具體任務。

社群還流傳出部分測試成績,據稱 Kimi K3 在部分測試中超過 Claude Opus 4.7GPT-5.5GPT-5.6 Terra,但與 GPT-5.6 SolFable 5 相比仍有差距。這些結果未經官方驗證,需謹慎看待。若最終成績接近傳聞,國產模型將不再只是追趕者,而是開始直接參與全球最高水平基礎模型競爭。技術規格方面,傳聞 K3 引數規模超過 2.5 萬億,可能支援百萬 token 上下文、原生多模態及新注意力架構,若屬實將成為國產大模型中規模最大的之一。

儘管跡象表明 Kimi K3 已具備公開測試條件,但正式釋出或仍受多重因素制約。模型穩定性方面,35 分鐘的生成時間意味著高昂的計算成本,如何降低成本、提升響應速度是商業化關鍵。產品設計上,會員體系、呼叫限制、價格策略及 Agent 服務模式均需提前規劃。釋出節奏上,如今的大模型釋出已演變為技術報告、產品體驗、生態合作與市場傳播的綜合競爭。因此,Kimi K3 可能並非未準備好,而是在等待更合適的時機。

從 LMArena 的 Kivine 到 beta 介面的 K3 資訊,再到洩露的運營頁面,線索正不斷匯聚。儘管月之暗面尚未確認,但 Kimi K3 已難以再稱為秘密。若最終證實,這不僅是一次模型升級,更可能成為國產 AI 競爭格局的重要節點。然而,其商業成敗不只取決於能力上限,更在於能否解決一個現實問題:一個需要 35 分鐘才能完成任務的超級模型,如何成為普通使用者每天願意使用的 AI 助手?這或許才是 Kimi K3 正式釋出後真正面臨的挑戰。