第一次听到这个事,整个人都麻了,AI公司正在大量购买孤本书籍,切掉书脊高速扫描,然后把原书直接销毁。
据报道,ISBNdb促成了多达一百万本书的订单,买家全程匿名,大家猜是Anthropic,这家公司启动了“巴拿马计划”,销毁数百万册实体书,包括存世量极少的绝版古籍。
而法院裁定这种做法合法,理由是“合法购买纸质书再加以破坏性扫描”属于合理使用,销毁原书意味着同一时间只有一份副本存在。
我认为,最大的讽刺就在这里:合法,不代表合理。
为什么非要销毁?直接原因很简单:效率,切掉书脊,书页自动进纸高速扫描,比逐页翻扫快得多。
但更深层的逻辑是规避版权风险,书扫完就销毁,原书从市场上消失,扫描件即使外泄,对方也没法拿着同一本书来主张权利,销毁是企业在现行法律框架下权衡后选出的“合规最优解”。
但代价是什么?
第一,文化损失不可逆,一本十八世纪的绝版古籍,经历战争、火灾、数百年翻阅流传下来,被切掉书脊、送进碎纸机,就再也回不来了。
扫描可以保存文字,但纸张、版本、批注、装帧,这些印刻在物理载体上的历史信息,高速扫描仪扫不走,粉碎机一响就永远消失。
第二,知识验证的依据没了, 如果AI给出的答案有问题,想核对原始出处,原始书已经被销毁了,语料库变成无法回溯的黑箱,后世研究者想查证一段引文,连载体都找不到。
更值得琢磨的是:Anthropic因为长期保存一个包含700万册盗版书的数据库,被法院判赔15亿美元,合法买来正版再销毁,反而被认为“不构成多重复制”。
这个逻辑链条,更像是一条绕开法律风险的捷径。
马斯克看不下去了,公开表示已要求团队用无损扫描方式保存珍贵书籍,避免破坏书脊,虽然慢,但书还完整,人类的文化遗产没有在技术迭代中被碾碎。
一个简单的道理:技术的目的应该是让知识更广地传播,而不是把知识锁进少数公司的数据库里,让后代再也找不到翻开书本的入口。
