智谱在发布港股上市后的首份中期业绩后,于8月31日召开中期业绩发布会及面向分析师的“Call back深入交流会”,披露了多项关键数据。公司首次给出年底ARR(年度经常性收入)指引为24亿美元,并坦言当前16亿美元的ARR水平相当于Anthropic在2025年3月的状态,落后约17个月。同时,API均价上调约101%后,token调用量较年初增长超40倍,显示出量价齐升的态势。
在电话会上,智谱董秘肖磊首次系统梳理了ARR的增长路径,并主动与Anthropic对标。他透露,公司此前仅有三次官方ARR披露:3月31日年报时的2.5亿美元、7月份的10亿美元,以及本次的16亿美元。他同时给出年底指引,将按线性关系定在24亿美元。肖磊坦言,智谱的ARR曲线呈现“脉冲式”增长,主要受算力供给阶段性错配影响,例如6月底ARR实际在5.3亿至5.4亿美元水平,这一数字此前从未公开。
在量价策略方面,肖磊在业绩发布会上披露,API平均售价提高约101%,但token调用量较年初增长超40倍,两者同步放大。他进一步补充,按收入计,前十大用户的日均调用量较年初增长了98倍。这一组合在商业上并不寻常——价格翻倍,用量却未萎缩,反而爆发。以编程订阅产品Coding Plan为例,该产品上线365天,调用量增长234倍,且上半年曾处于限售状态,直到7月算力改善后才重新放开,放开后套餐涨价,8月调用量依然增长15倍。肖磊解释,收入结构的变化并非主动设计,而是模型能力提升带来的自然演进。
针对毛利率问题,肖磊在电话会上首次给出明确方向性指引:12-18个月内,整体毛利率空间将“奔着50%以上”努力。他分析了当前毛利率偏低(上半年开放平台为24.6%)的四点原因:国产大集群尚处爬坡期、模型迭代快带来切换损耗、Infra优化仍有空间、产品定价结构精细化。他透露,过去半年单位推理成本已下降约80%,但仍有提升空间。
技术路径方面,首席科学家唐杰在业绩发布会上首次披露下一代模型的核心方向——“Fully Self-Training”,定义为模型从预训练到后训练全程自主进行,并能自我纠错、自我停止。他将此概念与海外的RSI(Recursive Self-Improvement)对应,并表示这是未来研究的重点。唐杰还回应了市场对“智谱只会后训练”的质疑,指出国内大模型训练数据普遍在30至50万亿token区间,在此规模下,模型过大收益并不显著。他透露,GLM-5系列所用的7440亿参数基座模型于今年1月确定,并规划了后续版本。
用户数据方面,截至8月末,MaaS平台注册用户超740万,较年初增长144%;付费日活用户增长603%。前十大用户日均调用量较年初增长98倍,占40万亿token调用量的近40%。此外,中国前十大互联网公司中,有4家已将GLM模型列为全球首要选择。肖磊还透露,公司正与海外云服务商洽谈合作,此前已与AWS在分发层面启动初步合作,预计1-2个月内或有进展。
在国产芯片方面,GLM-5.3 Flash在发布前以匿名模型“Ox-Alpha”上线测试,六天调用量超62万亿token,全程跑在国产芯片上,成为首次在超大规模真实流量中全面使用国产芯片集群的模型。公司已实现10万卡级国产芯片规模化推理,单位token推理成本较年初下降80%。智谱董事长刘德斌表示,成本曲线已掌握在自己手里。肖磊补充,下一阶段重点是验证国产芯片的经济性,预计未来三到六个月,先进国产芯片厂商可能放量,异构并行环境有望改善。