月之暗面(Moonshot AI)上週釋出的 Kimi K3 模型,在 AI 行業掀起了一場堪比“DeepSeek 時刻”的震動。創始人楊植麟用“AI 一天,人間一年”形容技術迭代之快,而 K3 的釋出讓這一說法顯得格外貼切:公司成立三年的積累,似乎抵不上釋出後三天的市場反響。
Kimi K3 的衝擊首先體現在資本市場。與去年年初 DeepSeek-R1 釋出後美國晶片股普跌類似,上週包括 輝達、博通 以及 美光 在內的 費城半導體指數 重挫 10%,創下自 2025 年 4 月以來最大單週跌幅,進入技術性熊市區間。媒體統計顯示,72 小時內 美股 AI 板塊合計蒸發 4700 億美元,約超 3 萬億人民幣。
海外媒體和研究機構紛紛用“DeepSeek 2.0”來形容 Kimi K3。《財富》雜誌稱這是“第二次 DeepSeek 衝擊”,《華爾街日報》強調 Kimi 加劇了華爾街晶片股拋售,彭博社則表示“Kimi 顛覆了美國領先中國的傳統認知”。恐慌情緒甚至蔓延至 OpenAI 和 Anthropic,這兩家正處於上市前關鍵節點的公司,其模型效能領先優勢受到質疑。部分美國開發者已在社交媒體上質疑為何還要為 Claude 和 GPT 支付高昂費用。
不過,有分析指出,半導體產業在此之前已連續承壓數週,華爾街分析師們迫切需要為下跌尋找一個足夠醒目的藉口。Kimi K3 的釋出恰好成為導火索,但並非唯一原因。OpenAI 和 Anthropic 本就處於激烈競爭中,已演變為價格戰。
儘管 Kimi 承認自身總體效能仍落後於 Claude Fable 5 和 GPT-5.6 Sol,但多家海外評測機構對 K3 不吝讚美。Arena.ai 稱 Kimi K3 以 1679 分 的成績獲得前端程式碼競技場榜首,超越 Claude Fable 5。該機構表示,上次中國模型如此接近領先,還是 2025 年的 DeepSeek-R1。
高昂的市場熱情甚至讓楊植麟成為美國科技圈熱議的新偶像。有外媒好奇他當年為何沒有留在美國,其博士生導師不得不專門發文解釋,澄清楊植麟回國並非由於簽證或移民問題,而是他堅定要回去創業。
Kimi K3 的效能優勢也帶來了商業上的成功。儘管其輸入及輸出價格均較上代 K2.6 模型上漲超 3 倍,顯著高於 GLM-5.2 及 DeepSeek V4 Pro,成為目前市面上最貴的國產模型,但 Kimi 依然遭遇了 算力緊缺 問題。7 月 19 日晚,Kimi 宣佈自即日起暫停 C 端新使用者訂閱,並調整了會員權益。Kimi 總裁張予彤稱,K3 釋出次日公司 ARR 創下歷史最大單日增幅。
算力緊缺部分與 K3 模型的 Token 效率相關。在 Artificial Analysis 的評測中,K3 完成整套測試輸出了 1.3 億個 Token,接近同類模型平均水平的兩倍。更長的輸出意味著更高的推理成本,進一步加重了算力壓力。社交媒體上,有開發者吐槽跑了 15 分鐘就耗盡了 5 小時的限額。
K3 的出圈再次證明了 AI 時代模型的 脆弱性。僅僅兩週前,中國大模型市場最被看好的還是已上市的 智譜 AI。上半年智譜釋出的 GLM-5.2 模型被譽為國產開源模型的驕傲,股價一度翻 24 倍,總市值突破 1.3 萬億港元。但從上週開始,智譜神話鬆動,兩個交易日內股價累計下跌超 4 成,市值跌破 5000 億港元。
Kimi K3 的領先可能也維持不了多久。7 月 19 日,阿里巴巴 釋出 Qwen3.8 Max 預覽版,引數規模達 2.4 萬億,宣稱綜合能力僅次於 Claude Fable 5。馬斯克 對外稱,擁有 2 萬億引數量的 Grok 新模型即將完成初步訓練,可能在保持較高執行效率的同時超越 Kimi。K3 釋出當天,薩姆·奧爾特曼 表示,他知道過去 12 個月並非最佳,但即將迎來最好的 12 個月。
晶片行業多年來奉行摩爾定律,而 AI 時代的模型效能提升可能以周甚至天計算。去年穀歌的 Gemini 模型一度令奧爾特曼在公司內拉響紅色警報,但現在 Gemini 更流行的稱謂是“北美豆包”。彭博社稱 Gemini 3.5 Pro 的釋出時間已推遲數月,因模型在程式設計及程式碼生成能力上未達預期。剛剛完成首輪融資的 DeepSeek 被曝即將推出 DeepSeek-V4 模型的正式版,外界稱效能將逼近 GPT-5.6。
過去的網際網路時代,先發優勢往往持續放大。但在 AI 時代,優勢的保質期往往只有一個版本。智譜今日盤中漲幅一度超 35%,市場訊息稱其已落地 1GW 級國產 AI 算力資料中心建設。競爭仍在繼續。