8月19日,宇树科技正式在A股上市,成为“人形机器人第一股”。此次IPO募集资金总额42.02亿元,其中20.22亿元投向智能机器人模型研发项目,11.10亿元用于机器人本体研发,其余资金用于新型智能机器人产品开发和制造基地建设。模型研发成为宇树最大的单一募投方向,凸显其对“大脑”技术的重视。
上市次日,宇树科技创始人王兴兴在2026世界机器人大会(WRC)上回顾了公司的模型研发历程。他表示,早在2020年初,宇树就开始探索基于视频生成的世界模型方向,但当时效果不理想,一度搁置。去年,公司重新聚焦这一方向,并持续加大投入。王兴兴透露,AI模型目前是公司资金和人力投入最大的领域。
在上市答谢午宴和世界机器人大会上,王兴兴多次提到宇树正在推进物理AI机器人模型自进化。具体而言,让AI模型自行编写机器人控制代码,在仿真环境中训练验证,再放到真机中反馈分析。他认为,基础模型越强,自进化能力越强;多源数据规模化,自进化效应越明显;真机部署越多,数据积累和迭代越快,最终形成规模化技能生态。这种“真机-数据-模型”闭环被视为物理AI行业的主要技术趋势。
行业分析指出,世界模型是通往具身智能终局的关键。在2026世界人工智能大会(WAIC2026)上,专家已区分“视觉生成模型”与“物理原生世界模型”。后者作为AI的物理直觉引擎,核心能力是预测动作后的世界真实状态,遵循动力学、空间、力学和因果规律,具备多模态融合感知、物理规律认知、因果长时序推理和闭环自迭代四大能力。其智能链路为:看见环境→推演世界变化→预判动作后果→执行动作→采集反馈更新模型。
世界模型赛道已聚集众多巨头。英伟达今年6月发布“全能”世界模型Cosmos 3,号称全球首个完全开源的全能模型;谷歌发布Genie 3,可实时生成交互式3D环境,为机器人和自动驾驶提供训练场景;李飞飞和杨立昆创办的初创公司也瞄准这一方向。谷歌DeepMind首席执行官Demis Hassabis曾表示,世界模型是通往AGI的关键部分。分析师将现有世界模型分为三大类:通用底座型(如英伟达Cosmos 3、Meta V-JEPA 2、Google Genie 3)、垂直专用型(如自动驾驶领域的Waabi Copilot4D、Wayve GAIA,具身智能领域的1X World Model等)和跨域复用型(如特斯拉FSD World Simulator、小米MiMo-Embodied)。
世界模型为物理系统提供两类关键能力:行动前推演和风险预判,以及生成大规模合成训练数据,缓解真实数据采集昂贵且危险的问题。国泰海通证券认为,谁掌握世界模型,谁就更有机会定义下一代机器人、自动驾驶与工业AI训练方式。分析师指出,世界模型的竞争本质是“下一代智能基础设施”定义权之争,AI竞争重心正从大语言模型转向物理AI。高质量数据集、仿真平台、训练算力和真实场景验证都需要长期投入,一旦形成平台将产生生态锁定,因此世界模型最终可能向国家主权AI框架、龙头科技平台和场景型大型企业集中。
在宇树上市前一天,工信部科技司副司长甘小斌在中国人工智能产业发展联盟第十八次全会上表示,下一步将一体化推进技术创新、应用落地、生态培育和安全治理,包括加快智能芯片等关键核心技术攻关,探索类脑智能、世界模型、物理模型等前沿技术。这为世界模型的发展提供了政策背书。