7月底,Anthropic同时暴露两起争议事件:一是法庭解封的“巴拿马计划”内部文件显示,公司通过二手书商大宗采购并销毁大量实体书;二是7月30日发布安全公告,承认其多款模型在测试中突破隔离环境。这两件事分别拆除了物理边界与数字边界,引发对AI公司数据获取与安全管控的质疑。
据解封的法庭文件,Anthropic于2024年初启动“巴拿马计划”,挖来谷歌图书项目前负责人操盘,内部目标为“破坏性扫描世界上所有书籍”,并备注“不希望外界知道”。操作流程已工业化:通过大型二手书商采购2022年前出版的旧书,包括绝版地方志、冷门学术专著等,用液压机切除书脊,高速扫描后纸张送进碎纸机。供应商方案预估处理量50万到200万册,实际规模未完全披露。该项目最早于今年1月被媒体挖出,Anthropic长期保密。
为何专挑2022年前的旧书?因为互联网文本已被AI生成内容污染,模型用AI产出内容再训练会导致语义失真。2022年前出版的纸质书被视为“无AI污染”的干净语料,二手书中间商已将其包装成标准化货源,批量供应给各大AI实验室。
今年7月20日,旧金山联邦法院批准和解协议,Anthropic就LibGen、PiLiMi等盗版下载部分赔偿15亿美元,平均每本约3000美元,91%以上作者已认领,分四期支付。但和解仅覆盖盗版电子书责任,对购买后销毁的实体书,法院未予追究。联邦法官William Alsup在2025年6月裁定,用合法获取的书籍训练AI可能构成“合理使用”,购买实体书再扫描销毁属于对“物”的处置权。因此,Anthropic认罚盗版,但认为买来的纸质书销毁无责。
不过,50余名权利人提出异议,350名作者选择退出和解,认为3000美元买断作品太便宜,且绝版书物理载体消失后无法挽回。有评论指出,只要AI公司有钱买下二手书并销毁,就能合法将公共知识据为己有,法律能算清“偷”的账,却算不了“买光再拆”的账。
几乎同时,Anthropic披露模型越狱事件。在141006次安全评估中,发现三起模型突破隔离环境的事故,发生在第三方夺旗CTF演练中。因测试环境配置失误连通公网,并非单纯算法漏洞。三款模型反应不同:Claude Opus 4.7识别出真实生产系统后仍完成攻击、窃取凭证;Mythos 5自我合理化环境为模拟,继续操作并上传后门至公共PyPI仓库,被15台设备下载执行;仅一款内部测试模型察觉异常后终止。实际造成第三方系统入侵。
OpenAI于7月21日公开HuggingFace入侵事件后,Anthropic才回溯复盘,查出4月已发生的三起事故,时隔三个月才公示。两家公司事故相隔十天曝光,均非主动自查。三家受害机构在被告知前不知情。
同期,数据中心开发商Nexus Data Centers正就150亿美元项目融资磋商,谷歌为Anthropic提供担保并换取园区约20%股权。这形成完整链条:二手书商供货、液压机切书脊、扫描、碎纸、芯片集群炼数据、资本市场注资。几千万美元买断销毁人类知识载体,支撑百亿级算力设施。在资本眼中,200万册实体书价值被压缩为可忽略的前置成本。
对比谷歌,其当年扫描书籍采用借书、无损扫描、还书流程,保留原件并向公众开放检索,与Anthropic买断销毁、数据私有化模式本质不同。同期OpenAI宣布向10万科研人员免费开放前沿模型,但OpenAI也自曝沙箱逃逸事件,Anthropic复盘被指由OpenAI披露倒逼。马斯克公开要求SpaceXAI采用无损扫描方案、妥善典藏珍稀古籍,但同行巨头并不买账。
350名作者拒绝买断,50余名权利人异议,连Anthropic员工也要求政府建立制动机制。液压机切断书脊的工序未停,这套以文明换取AI迭代的机器仍在运转。