TL;DR: AI公司正秘密收购、扫描并销毁数百万册实体书用于训练模型,将人类知识永久锁在私营企业服务器中。Anna’s Archive紧急呼吁全球志愿者在这些文化遗产彻底消失前扫描并上传书籍。
多家AI公司正通过中间商大量收购二手书,扫描后销毁,只为获得2022年之前“未经机器接触”的训练数据。
Anthropic的“Project Panama”在15亿美元版权和解案中被曝光。2024年初,他们启动了这项高度机密项目。该公司已花费数千万美元购买数百万册纸质书,扫描后用于训练其Claude大语言模型,然后全部销毁。令人愤慨的是,这一行为在法律上被允许,但在道德上,这是对人类极其严重的犯罪。
那么,为什么销毁实体书?背后是AI竞赛与资本利益:
AI公司一旦大规模扫描并销毁实体书,它们就成为世界上唯一拥有这些书籍数字副本的机构。知识被永久垄断在私有服务器上。
这场围绕旧书的争夺揭示了一个悖论:AI公司一边承诺“让人类知识触手可及”,一边却在拆毁人类知识最坚实的载体。公众或许会得到更智能的AI助手,但代价是大量知识资源从公共领域消失。
作为全球最大的影子图书馆,Anna’s Archive需要一项计划来对抗AI公司对实体书的销毁。毕竟,影子图书馆的出现是21世纪知识共享最伟大的奇迹。与其他影子图书馆一道,我们正在建造一座亚历山大数字图书馆——人类不灭的光芒。
我们需要全球志愿者的帮助,从世界各地每一座图书馆和档案馆扫描资料(包括书籍、期刊文章、报纸、杂志、古籍、善本等),并上传至影子图书馆进行知识保存,尤其是那些容易散失的资料。如果每个人都扫描一本书,而全球有1000万志愿者,我们就能获得1000万份无价的财富。
自2025年初以来,AI生成内容已占新发布互联网内容的一半以上。一个可怕的事实浮现出来:如果未来大量内容由AI生成的书籍和论文构成,人类还能分辨它们吗?一旦AI吸收了人类写在纸上的最后一句话,互联网上剩下的将只有AI自己的话语。在这样的世界里,人类文明如何存续?