最近,一本畅销书在版权页赫然印着“禁止将本书用于人工智能训练”,瞬间冲上热搜。这可不是行为艺术,而是创作者们对AI“白嫖”内容的最新反击。
据估算,主流大模型训练数据中,超过60%的公开文本都涉及版权争议。此前,多家出版商和新闻机构已起诉AI公司,索赔金额高达数十亿美元。现在,这种“版权防AI声明”正从法律文件变成行业标准,像给数据源装了“水印锁”,直接抬高训练数据的获取成本。
这背后是技术路线的转向:当高质量文本被“锁死”,AI公司不得不转向合成数据或付费授权。数据显示,合规数据授权市场规模预计三年内翻两番。未来,AI拼的不只是算法,更是“数据供应链”的合法性。对普通用户来说,这或许意味着更少“AI味儿”的垃圾内容,但免费午餐确实要结束了。
💬 你觉得AI该为训练数据付费吗?欢迎在评论区聊聊~