AI公司买珍稀书扫描后销毁,马斯克要求手下别毁书
此前报道,人工智能公司正在大量收购稀缺图书,使用切除书脊的高速扫描设备进行数字化,随后将纸质原件粉碎销毁。型扫描设备,在不拆解图书的情况下完成数字化。而破坏性扫描则会直接拆开书籍,将每一页送入高速工业扫描仪进行处理。公司普遍选择这一方式,最终导致数百万本纸质图书被拆毁。
版权诉讼阴影下的AI训练数据争夺战
致力于人工智能研究的公司, 为了收集到用于训练的数据信息, 不惜耗用数百万美元去购置纸质书籍。这些纸质书籍被以很快的速度进行扫描之后, 纸质的原始版本当即遭到粉碎并被销毁掉。这样的行为引起了拥有版权一方极其强烈的不满情绪, 许多家参与出版业务的机构以及负责创作的作者均已针对该人工智能公司提起有关侵犯知识产权的法律诉讼。全球知名企业家马斯克公开表明态度主张其团队采用不会对纸质书籍造成破坏的扫描方式, 这恰恰是对于这场围绕版权问题所产生争议的一种直接性回应。
破坏性扫描为何成为AI公司首选
从事破坏性扫描, 得先把书脊切除掉。然后把书籍拆分成单页, 接着再送进高速工业扫描仪里。在2025年的时候, 有一家AI公司, 仅仅只用3个月时间, 就扫描了数量超过50万册的图书。并且每册图书的成本不到2美元, 然而要是采用把俯拍扫描仪当作设备的非破坏性方式, 扫描同样数量的图书, 需要6个月时间, 而且人力成本还是前者的5倍。效率和成本之间存在的巨大差距, 致使大多数AI公司选择了前面那种方式, 也就是破坏性扫描方式。
珍稀图书的数字化困境
许多于19世纪出版的存在稀少珍贵程度的图书, 在全球范围内的存量是不足100册的, 这些图书的书页呈现出已经发黄且变脆的状态, 当运用传统扫描仪进行翻页这一操作时是极容易造成破损情况发生的。而进行非破坏性扫描这种方式虽然对原件起到了保护作用, 可是存在扫描速度慢以及图像质量不稳定这样的问题。在2026年6月这个时间节点上, 大英图书馆尝试采用V型扫描设备去处理一套属于18世纪的百科全书, 单册处理所耗费的时间为8小时, 然而仍然出现了3页因为反光而造成的数据缺失情况。
马斯克表态背后的商业逻辑

旗下公司为马斯克的那家, 正因开发新一代AI模型, 所以需要巨量高质量文本数据。公开表明要保护珍稀图书, 如此一来既能躲开版权诉讼风险, 还能塑造企业的那种社会责任形象。在2026年7月那时候, 此公司已然和5家古籍收藏机构达成了合作, 是以非破坏性方式扫视大概1.2万册稀有文献, 并且承诺数字化副本将会朝着学术界免费进行开放。
数百万册图书被毁的真实代价
由 404 的团体进行探讨, 仅仅是在二零二五年这唯一年份, 美利坚的人工智能企业就实施了大约一百八十万册纸质书籍的销毁举措, 这些书籍当中存在着好些属于绝版教材、地方志以及手稿的类型, 纽约公共图书馆的负责人表明, 这批被毁坏的图书室当中大概有百分之十五不曾留有任何数字备份, 这所表达的含义是这些知识所含内容已经彻底永久不见消失, 有部分图书馆开始施行拒绝朝着人工智能公司出售其所拥有的馆藏书籍了。
非破坏性扫描技术的突破方向
到2026年的时候, 英国剑桥大学的团队研制出了新型自适应扫描仪这种东西, 它可以根据纸张的厚度去自动调整压力, 并且把翻页速度提升到了每分钟能够达到12页的程度。德国蔡司公司推出了多光谱扫描方案, 该方案能够同时去捕捉文字以及纸张纤维的细节, 然而此方案中的单台设备价格高到了80万美元。要让这些技术大规模地进行商用, 依旧需要将成本降低到至少要有70%才行。
需要数据来进行AI训练, 然而, 毁掉人类知识载体用以喂养机器, 这样的代价, 我们能够承担吗, 欢迎在评论区说出你的看法, 点赞分享以使更多人关注这个问题。