月之暗面(Moonshot AI)上周发布的 Kimi K3 模型,在 AI 行业掀起了一场堪比“DeepSeek 时刻”的震动。创始人杨植麟用“AI 一天,人间一年”形容技术迭代之快,而 K3 的发布让这一说法显得格外贴切:公司成立三年的积累,似乎抵不上发布后三天的市场反响。
Kimi K3 的冲击首先体现在资本市场。与去年年初 DeepSeek-R1 发布后美国芯片股普跌类似,上周包括 英伟达、博通 以及 美光 在内的 费城半导体指数 重挫 10%,创下自 2025 年 4 月以来最大单周跌幅,进入技术性熊市区间。媒体统计显示,72 小时内 美股 AI 板块合计蒸发 4700 亿美元,约超 3 万亿人民币。
海外媒体和研究机构纷纷用“DeepSeek 2.0”来形容 Kimi K3。《财富》杂志称这是“第二次 DeepSeek 冲击”,《华尔街日报》强调 Kimi 加剧了华尔街芯片股抛售,彭博社则表示“Kimi 颠覆了美国领先中国的传统认知”。恐慌情绪甚至蔓延至 OpenAI 和 Anthropic,这两家正处于上市前关键节点的公司,其模型性能领先优势受到质疑。部分美国开发者已在社交媒体上质疑为何还要为 Claude 和 GPT 支付高昂费用。
不过,有分析指出,半导体产业在此之前已连续承压数周,华尔街分析师们迫切需要为下跌寻找一个足够醒目的借口。Kimi K3 的发布恰好成为导火索,但并非唯一原因。OpenAI 和 Anthropic 本就处于激烈竞争中,已演变为价格战。
尽管 Kimi 承认自身总体性能仍落后于 Claude Fable 5 和 GPT-5.6 Sol,但多家海外评测机构对 K3 不吝赞美。Arena.ai 称 Kimi K3 以 1679 分 的成绩获得前端代码竞技场榜首,超越 Claude Fable 5。该机构表示,上次中国模型如此接近领先,还是 2025 年的 DeepSeek-R1。
高昂的市场热情甚至让杨植麟成为美国科技圈热议的新偶像。有外媒好奇他当年为何没有留在美国,其博士生导师不得不专门发文解释,澄清杨植麟回国并非由于签证或移民问题,而是他坚定要回去创业。
Kimi K3 的性能优势也带来了商业上的成功。尽管其输入及输出价格均较上代 K2.6 模型上涨超 3 倍,显著高于 GLM-5.2 及 DeepSeek V4 Pro,成为目前市面上最贵的国产模型,但 Kimi 依然遭遇了 算力紧缺 问题。7 月 19 日晚,Kimi 宣布自即日起暂停 C 端新用户订阅,并调整了会员权益。Kimi 总裁张予彤称,K3 发布次日公司 ARR 创下历史最大单日增幅。
算力紧缺部分与 K3 模型的 Token 效率相关。在 Artificial Analysis 的评测中,K3 完成整套测试输出了 1.3 亿个 Token,接近同类模型平均水平的两倍。更长的输出意味着更高的推理成本,进一步加重了算力压力。社交媒体上,有开发者吐槽跑了 15 分钟就耗尽了 5 小时的限额。
K3 的出圈再次证明了 AI 时代模型的 脆弱性。仅仅两周前,中国大模型市场最被看好的还是已上市的 智谱 AI。上半年智谱发布的 GLM-5.2 模型被誉为国产开源模型的骄傲,股价一度翻 24 倍,总市值突破 1.3 万亿港元。但从上周开始,智谱神话松动,两个交易日内股价累计下跌超 4 成,市值跌破 5000 亿港元。
Kimi K3 的领先可能也维持不了多久。7 月 19 日,阿里巴巴 发布 Qwen3.8 Max 预览版,参数规模达 2.4 万亿,宣称综合能力仅次于 Claude Fable 5。马斯克 对外称,拥有 2 万亿参数量的 Grok 新模型即将完成初步训练,可能在保持较高运行效率的同时超越 Kimi。K3 发布当天,萨姆·奥尔特曼 表示,他知道过去 12 个月并非最佳,但即将迎来最好的 12 个月。
芯片行业多年来奉行摩尔定律,而 AI 时代的模型性能提升可能以周甚至天计算。去年谷歌的 Gemini 模型一度令奥尔特曼在公司内拉响红色警报,但现在 Gemini 更流行的称谓是“北美豆包”。彭博社称 Gemini 3.5 Pro 的发布时间已推迟数月,因模型在编程及代码生成能力上未达预期。刚刚完成首轮融资的 DeepSeek 被曝即将推出 DeepSeek-V4 模型的正式版,外界称性能将逼近 GPT-5.6。
过去的互联网时代,先发优势往往持续放大。但在 AI 时代,优势的保质期往往只有一个版本。智谱今日盘中涨幅一度超 35%,市场消息称其已落地 1GW 级国产 AI 算力数据中心建设。竞争仍在继续。