销毁200万册纸质书!AI争抢语料,全球版权争端升温

2026年7月,随着美国AI公司Anthropic与作家群体15亿美元版权和解协议最终敲定,超4000页解封法庭文件披露,该公司代号为“巴拿马计划”的秘密项目浮出水面:Anthropic斥资数千万美元,批量采购数百万册2022年之前出版的纸质书,切除书脊扫描提取文本后将实体书粉碎销毁,累计处理图书约200万册,其中包含不少绝版书、小众文献与地方史料。美国联邦法院已裁定这一做法属于“合理使用”,相关信息披露后引发全球舆论关注。

据美国斯坦福大学发布的《2026年AI指数报告》,2025年起全球互联网新发布内容中,AI生成内容占比已超过半数。行业内公认,若反复使用AI生成内容训练模型,会出现“垃圾进,垃圾出”的问题,导致模型性能下降甚至崩溃。当前大模型行业竞争中,通用互联网公开语料已成为公共资源,模型能力差距逐步集中在独家、稀缺的高质量语料层面,2022年之前出版的纸质书因物理层面不存在AI生成内容,成为AI企业追捧的“纯净人类语料”。

近期国内有读者发现,华夏出版社在新出版的《新译黄庭经 阴符经》等书籍版权页,标注“禁止将本书内容用于人工智能训练,违者必究”,引发广泛关注。

当前全球AI行业围绕训练数据的版权纠纷持续增加,法国新闻媒体协会近日已向监管机构申诉谷歌AI摘要服务侵权,苹果正与多家新闻机构洽谈,计划投入最高数亿美元采购新闻内容版权用于AI驱动的Siri升级,字节跳动近期也专门成立一级部门“AI数据与安全”,提升数据在AI战略中的组织定位。

市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。

资讯所属栏目还有更多独家策划、专家专栏,免费查阅>>

AI智能分析该文,为您挖掘投资机会该AI功能处于试用阶段,内容仅供参考,请仔细甄别!
展开
全部评论
金融界App
金融界微博
金融界公众号