🎯 科技 · AI安全
一、欧盟一纸规定,Anthropic连夜加水印🔥 欧盟强制打水印仅两周,去水印工具已狂揽近2万星标,合规要求撞上技术现实,谁在为虚假安全感买单?
8月中旬,Anthropic宣布要给Claude所有生成产物打上隐形水印,包括文本和图片。这个消息在网上炸了锅。理由是合规——欧盟《人工智能法案》第50条明确规定,生成式AI的输出必须携带机器可读标记,目的是识别内容是否由AI生成或修改。法案8月2日生效,对8月2日前上线的旧模型给予过渡期至今年12月2日,违反者最高可被罚全球年营业额的3%或1500万欧元,取较高者。合规压力之下,Anthropic选择了最激进的做法:All-in水印。这一决定不仅让习惯了Claude的用户愤怒,更在短时间内催生了规模空前的"反水印"运动。
据网易报道,几天之内,多款"水印去除器"在GitHub发布。最受欢迎的是法国开发者Guillaume Meyer制作的Watermarks remover,被星标1.9万次,在X上也有2万收藏。与此同时,AI水印去除的谷歌搜索量环比上升60%,多个免费开源的水印移除项目涌现。#刚刚Claude水印一夜变废纸#这个热榜标题并非夸张——从技术层面的脆弱性,到执行层面的草台班子,这场声势浩大的水印运动正在撞墙。
二、水印技术有多脆弱?一图一截就废Claude的图片水印遵循C2PA(内容来源与真实性联盟)开放标准,在非专业用途上暴力破解就够:图片格式转换、手机截图、甚至发微信再另存,都能轻易剥离元数据。而文本水印采用的是SynthID-Text技术,原理是在模型生成每个词时,根据密钥和上文,给候选词打上看不见的随机概率偏移。读者感觉不到区别,但机器能通过统计规律识别。
问题是,这种水印在技术层面存在先天脆弱性。ICML 2026论文《StreamingMeme》证明,线性集成方法可以抹除分布扰动型水印。更具体的场景是:经过格式化、局部改写、换一种表达之后,水印信号大幅衰减甚至完全消失。一位开发者测试后表示,"用普通的大模型对Claude输出做一次同义改写,水印就直接没了"。雷峰网分析指出,代码水印面临的核心限制是编码容量——变量声明、JSON字段、SQL语句等低熵位置几乎没有空间承载额外信号,而在高熵位置嵌入标记又遇到"代码短、结构化token比例高、可利用位置不足"的问题。可检测强度、生成质量和抗修改能力,三者之间形成了直接取舍。
三、执行层更是一场草台班子监管要求已经下了,但执行能力根本跟不上。谷歌算是走得最快的,已让Gemini给多种输出打水印并开源了SynthID-Text框架,但尚未有针对Claude水印的检测工具。OpenAI目前只给图像和音频加了水印,连检测器都没有,更别说文本。Meta、微软等公司的进度更加落后。更尴尬的是,欧盟27个成员国中并非各个都已指定好负责监管的机构。
果壳评论指出,欧盟法案要求"用一个检测器就能检测出各家水印",但各家采用不同技术、不同密钥、不同标准,连互操作性都还没对齐。北京大学数学科学院苏炜杰教授的研究指出,无偏水印方法依赖文本长度积累统计信号,一旦内容被截断、改写或混合人工输入,验证准确率就会断崖式下降。AI水印运动看似轰轰烈烈,实则从技术标准、检测工具到监管人员,全线处于"草台班子"状态。1.9万星标的去水印工具,恰恰是对这场运动最响亮的讽刺——当合规要求撞上技术现实,最先破产的往往是虚假的安全感。
综合网易、雷峰网、果壳网报道 | 2026年8月29日