📚 AI · 版权争议

🔥 华夏出版社首次在纸质书版权页明确拒绝AI训练,揭开了出版业与AI公司之间版权博弈的序幕——这不是一句口号,而是创作者对数据掠夺的正式宣战。

一、版权页上的八个字,出版业的"避妖符"

近日,华夏出版社有限公司出版发行的《新译黄庭经 阴符经》等书籍,在版权信息页赫然标注了"禁止将本书用于人工智能训练"的提示。这是国内出版社首次将此类声明正式写入纸质书的版权页,引发舆论广泛关注。有网友调侃称这就像果园门口挂牌子写着"鸟不准吃葡萄"——明知鸟看不懂,但人得把态度亮出来。出版界对此事的反应几乎是共鸣式的,因为这八个字背后藏着整个行业对AI训练数据来源的集体焦虑。更值得关注的是,华夏出版社这次的 #禁止将本书用于人工智能训练# 声明并非孤立事件,而是出版行业对AI"吃书"行为的一次集体反击。

从法律角度来看,版权页上的这句声明虽然不能自动决定某种AI训练行为是否合法,但它具有关键的法律预告意义——明确表达了权利人对数据使用的拒绝意愿。按照现行法律原则,一旦未来技术能够追溯训练数据来源,这句声明就能直接证明出版社早就明确拒绝过授权,对方属于故意侵权,单部作品的赔偿上限可提至百万元级别。

二、200万本书被毁,AI"吃书"的方式比想象中更粗暴

与华夏出版社的温和"贴告示"形成强烈对比的,是美国AI公司Anthropic对待纸质书的做法。据内部信息显示,Anthropic通过中间商大量采购二手正版书,用工业裁纸机切掉书脊进行快速扫描后,三年内销毁了约200万本实体书。更令人震惊的是,该公司还从盗版网站LibGen和Books3下载了700多万本电子书用于模型训练。今年4月,Anthropic与作者及版权持有人达成15亿美元的和解协议,创下AI侵权赔偿的新纪录,但这一事件对整个出版生态造成的伤害已经难以估量。

在涉及Anthropic的案件中,法院的判决逻辑值得注意:其购买纸质书转为数字格式的行为被认定为合理使用;但使用盗版书籍的行为则被认定为非合理使用。可见来源不同、用途不同,法律评价截然不同。这也给国内AI公司敲响了警钟——用"黑箱训练"来规避版权责任的时代正在结束。

三、全球围剿AI"白嫖",版权博弈进入新阶段

事实上,对AI训练数据的版权管控已成为全球共识。欧盟计划立法要求AI公司公布训练数据来源,日本6月发布指南规定2000年后出版的纸质书不得随意扫描,中国7月国家版权局首次点名批评破坏性采集实体文献的行为。商业层面也在加速洗牌:OpenAI与新闻集团签下五年2.5亿美元协议,Google和Reddit每年分别支付6000万和7000万美元购买语料。版权页上的八个字表面是防御,实质是在试探数据定价权的边界

正如广州日报评论所言,高质量语料离不开源源不断的优质创作。保护版权,既是保护创作,也是守护AI发展的源头活水。在训练系统里,书籍可以转化为数据;但在文明长河中,书籍承载着不可替代的文化记忆。让AI"读万卷书"固然是好事,但别漏了"版权"这一页。

综合广州日报、今日头条报道 | 2026年8月10日