AI巨头开启“数字焚书”,优质语料稀缺催生全新版权赛道
近期曝光的“巴拿马计划”引发行业热议,Anthropic大批量收购2022年前出版书籍,破坏性扫描提取文本训练大模型,扫描完成后直接粉碎实体图书,其中包含不少绝版古籍。
之所以不惜销毁原书争抢旧典籍,核心痛点在于互联网内容持续被AI生成文本污染。早年纯人工撰写的书籍,成为大模型仅剩的高质量、无污染训练素材。
一边是AI企业疯狂抢占图书语料资源,另一边海外出版商接连对谷歌、AI企业发起大规模版权诉讼。矛盾背后,图书版权正在从传统出版资产,转变为人工智能时代的底层战略资源。
国内机构测算,文化IP数字化运营将打开千亿增量空间,手握清晰版权内容的出版企业,有望持续享受大模型产业链长期红利。
个人观点:数据争夺只是开端,全球范围内AI训练内容的版权规则,未来几年将会迎来大范围重塑。
风险提示:本文仅行业资讯分享,不构成任何投资参考
信息来源:科创板日报、财联社
