现在的AI行业已经卷到开始“焚书”了!美国顶级AI巨头Anthropic藏了一个惊天秘密,内部文件直白写道:我们不希望外界知道我们在做这件事。
这个绝密项目代号巴拿马计划,操作简单却极度疯狂:批量收购全球纸质书籍,暴力裁切书脊、高速扫描录入AI数据库,最后直接粉碎销毁原件。
短短两年,整整200万册实体书彻底化为纸浆,只为给Claude大模型换取干净的训练数据。
这件事最早在2026年露出破绽,最初只是各地旧书商察觉异常。美国稀有书商家发现,原本一周卖二十本就不错的生意,突然有人每周大批量下单,只按ISBN编号买书,不问品相、不砍价格,出手极其阔绰。不止美国,荷兰、德国、瑞士、西班牙的独立书商,全都接到过匿名海外公司的巨额订书订单。
这些买家伪装成普通藏书爱好者,大批量扫空冷门旧书、绝版典籍、地方史料,全程神秘低调。直到外媒深挖溯源,所有人才恍然大悟:这些疯狂收书的匿名买家,背后全是AI公司。他们根本不爱书、不藏书、不读书,收书只为扫描数字化,扫描完成立马销毁,杜绝书籍二次流通。
很多人疑惑,AI网上海量文字随便用,为什么非要大费周章买书毁书?核心原因,是整个AI行业都在焦虑的致命难题——模型坍塌。
早年AI训练,靠的是维基百科、新闻、论文、博客等纯人类原创网络内容,数据干净、逻辑严谨、质量极高。
但2022年AI爆发后,全网铺满AI生成的文字,真假混杂、逻辑混乱。AI开始吃自己产出的内容反复训练,数据持续污染、层层劣化,最终只会越来越笨、胡言乱语,彻底陷入内卷死循环。
这也就意味着,2022年之前人类手写、校对、出版的纸质书,成了AI仅剩的纯净数据水源。图书数据公司直言:当下最好的AI训练数据,全部藏在纸质书架上。
为了抢占这份稀缺资源,背靠前OpenAI核心团队的Anthropic直接下场,开启粗暴的掠夺式操作。手段分明暗两路,明面砸数千万美金,合法批量收购全球二手实体书;暗地通过盗版平台,窃取近700万册电子图书,用来扩充训练数据集。
为了把这套流程做到极致,公司专门挖来谷歌图书项目原负责人,定下终极目标:收录全世界所有书籍。
相比盗版电子书的法律风险,实体书收割堪称“完美套路”:合法买书、裁切扫描、销毁原件,整套流程规避版权漏洞,成本极低、效率拉满。无数绝版孤本、小众史料、地方文献,就这样被彻底销毁,从此世间再无原本,只留存于AI数据库中。
纸终究包不住火,这场疯狂计划很快曝光,还引发了天价版权诉讼。
2025年,多名美国作家集体起诉Anthropic侵权。最终法院裁定:公司盗版下载700万册图书属实,构成严重侵权,需赔付15亿美元,创下美国版权诉讼史上最高赔偿纪录。
但最让人细思极恐的是法院的另一项判决:合法购书、裁切扫描、销毁原件用来训练AI,属于合理使用,完全合规。
简单来说,花钱买的书,切碎扫描、销毁存档,法律挑不出任何毛病。15亿赔偿金,对Anthropic而言根本不算损失,更像是花钱买断了“毁书训练AI”的合法资格,这笔买卖它稳赚不赔。
此事曝光后全网哗然,连马斯克都忍不住公开怒怼。他亲自表态,要求旗下SpaceX AI团队坚守底线,采用无损扫描技术,珍藏所有珍贵书籍,绝不以破坏、销毁原件为代价换取训练数据。这番公开站队,不仅是同行竞争,更直接戳穿了当下AI行业的病态内卷。
真正让人不寒而栗的,从来不是消失的200万本书,而是背后恐怖的行业趋势。过去几个世纪,人类一代代沉淀、校对、传承的纸质知识,本是全人类共享的公共财富。如今却被少数AI巨头,用合法却霸道的方式彻底私有化。
买书、扫录、粉碎、销毁,一套流程下来,实体书彻底消失,人类原版知识不复存在,唯独AI神经网络永久留存这份内容。
隐秘的巴拿马计划虽然被曝光,但这场悄无声息的知识掠夺,早已无法叫停。
当人类的文明沉淀,最终沦为AI迭代升级的专属养料,这场科技进步,到底是进步,还是文明的遗憾?
