焚书!多家AI公司疯狂扫货旧书,扫描录入后直接销毁📚
近日媒体曝光,多家头部AI企业通过中间商秘密大批量收购二手旧书,单笔采购规模最高可达百万册😱。它们优先锁定2022年前出版纸质书籍,只为获取没有AI内容污染、纯粹由人类创作的文字素材,用来训练大模型。
如今互联网充斥大量AI生成的低质内容,如果持续使用这类数据训练,会造成模型同质化、性能持续退化。未经AI污染的旧书本,自然而然成为行业争抢的稀缺资源!
而更引发巨大争议、让人难以接受的操作来了⚠️:大量书籍会采用破坏性扫描,直接拆掉书脊高速录入文字。数字化完成之后,这些实体旧书直接粉碎销毁,再也不会流入二手市场。
此前海外AI企业Anthropic就投入巨资采购数百万册图书训练Claude,事后销毁书籍,还因为存储盗版图书数据被判赔付15亿美元。尽管部分判例认定,合法购入图书仅用于训练属于“合理使用”,可大批绝版、稀缺书籍就此永久消失,人类沉淀下来的文字知识,被少数企业私有化垄断,引发无数作家、藏书爱好者强烈担忧!
一边是AI技术狂奔发展,急需优质原始语料喂养模型;一边是珍贵的人类文字遗产不断流失、实体典籍灰飞烟灭。这场疯狂争抢旧书的竞赛,背后藏着AI时代绕不开的数据伦理难题。
何其讽刺!古人焚书,为禁锢思想、断绝文脉;今人焚书,为喂养算法、垄断知识❗❗
这根本不是技术进步,这是赤裸裸的文明自残、是新时代最荒唐、最不堪入目的文化浩劫🤬!
无数绝版典籍、孤本珍籍、几代人沉淀的智慧结晶,就这么被机器无情碾碎、彻底销毁!人类千年传承的书香文脉、真实文明印记,正在被资本和AI悄无声息地抹除、掏空、毁灭!
这种肆无忌惮、野蛮疯狂的毁书行为,必须引起国家有关管理职能部门的高度重视、强力监管、严厉整治❗❗
绝不允许资本为了算法利益、商业盈利,肆意摧毁人类千年文脉!绝不允许AI野蛮生长,透支文明根基、割裂历史传承、斩断文化根骨🔥!
知识可以数字化,但文明不能被销毁!数据可以被训练,但文脉绝对不能被断送!放任这种乱象持续下去,最终毁掉的,是整个人类的文明底蕴与文化根基!


