8 月 7 日,OpenAI 宣布 ChatGPT 每周活跃用户达到 10 亿,同时将 GPT-5.6 Luna 开放给免费用户,文本对话不限次数。而就在前一天,多名 DeepSeek API 用户收到通知,公司计划近期整体上调 API 服务价格,预计涨幅较大,具体价格和执行时间待后续公告。一升一降之间,大模型行业的攻守态势正在发生微妙变化。
OpenAI 的免费策略并非慈善。GPT-5.6 Luna 定位中等能力区间,足以应对日常对话、简单写作和基础翻译,但复杂推理和多步骤代码分析仍需更高级的 SOL 系列。OpenAI 用一款“够用就好”的模型覆盖最广的用户场景,其底气来自成本端的快速下降:过去 18 个月,大模型推理的单位 Token 成本曲线陡峭下滑,模型架构优化、量化技术成熟和推理引擎升级,使同样算力集群能服务的请求量是两年前的几十倍。当边际成本足够低,免费就接近谷歌搜索的逻辑——入口免费,生态收钱。
然而,免费策略的代价同样清晰。2026 年一季度,OpenAI 收入 57 亿美元,非 GAAP 经营亏损率 -122%,每赚 1 美元要倒贴 1.22 美元,全年预计净亏 140 亿美元。10 亿周活中,付费订阅者仅 5000 万,付费率约 5%。订阅费显然无法支撑公司运营,收入来源正在转向广告和企业服务:广告业务上线 6 周即达到 1 亿美元年化收入;企业 API 持续扩张,Codex 每周 500 万用户,企业客户贡献超过 40% 的收入。ChatGPT 的商业模型正从“卖模型订阅”切换为“收平台税”——模型免费,靠广告、企业服务和开发者生态变现。
DeepSeek 的处境则完全不同。其 V4 Flash 模型在 OpenRouter 全球调用量周榜登顶,单周处理 7.22 万亿 Token,据 OpenCode 数据,仅 8 月 1 日单日处理量就达 8 万亿 Token。工作日高峰时段接口超时和卡顿频发,7 月中旬已推出峰谷定价机制(高峰翻倍),8 月 6 日直接预告全面大幅涨价。根本原因是用户太多、算力不足:过低的定价吸引了大量低频次、低付费意愿的调用,服务器资源被无效请求挤占,真正需要深度推理的企业和开发者反而得不到稳定体验。DeepSeek 需要把“拿 AI 当玩具”的用户挡在门外,让愿意为高质量推理付费的人留下来。
这一逻辑与豆包 6 月 24 日上线付费版(68/200/500 元三档月费,基础功能保持免费)如出一辙。豆包拥有 3.45 亿月活,日均消耗数千万元推理成本,电商佣金难以弥补。国内大模型竞赛白热化,融资环境转冷,算力不足始终是紧箍咒,过去靠资本续命、无限补贴的打法难以为继,证明自己能赚钱比证明技术领先更紧迫。当然,涨价不意味放弃价格优势,更准确的说法是价格战的冷启动阶段结束——此前任务是“让用户用得上”,现在变成“让用户愿意为好东西付钱”。
从 GPT-4 时代比拼模型能力,到 GPT-5.6 Luna 阶段顶尖模型差距缩小,竞争正从“谁更聪明”转向“谁更离不开”。OpenAI 选择免费,赌的是用户时长和入口地位,要成为大多数人接触 AI 的默认方式;中国厂商提价或推付费版,则是在资本退潮和算力管制下寻找商业闭环,不再满足于“用户很多但不赚钱”。方向相反,焦虑对称:OpenAI 要在融资窗口关闭前证明平台税能覆盖推理成本,中国公司要在算力见顶前把用户规模变成可持续收入。
这场分化可能形成三层结构:最底层是日常对话和通用问答,模型能力溢出、成本极低,免费成为常态;中间层是专业推理(代码、数据分析、法律、医疗),用户愿为结果付费,DeepSeek 和豆包的付费版主攻此层;最上层是 Agent 执行,AI 直接替用户完成操作,收费模式从按 Token 计费转向按成果计费。不计成本的免费时代正在结束,留下来的免费,都是算得过账的生意。