近期,人工智能企业Anthropic为了让AI生成的文本更容易被辨别,在其部分Claude模型中引入了一种“不可感知的水印”。这种水印是通过Claude独特的选词方式形成的统计模式来实现的,即便用户直接复制粘贴,水印也会跟随内容一同保留。Anthropic表示,此举是为了履行欧盟《人工智能法案》的相关承诺。

然而,这一举措在科技行业引发了不小的争议。许多用户和从业者担忧,即使用户只是利用Claude进行基础的文本校对、翻译或总结,这种隐形标记也会跟随最终成果一同传播。此前甚至有用户向媒体反映,他们因此取消了Claude的订阅服务。为了应对这一情况,相关搜索热度直线上升,各类专门用于消除文本中AI标记的去水印工具也开始涌现。

面对用户的反弹与需求,多位开发者迅速行动推出了应对方案。来自巴黎的科技创业者、AI电商工具Memo创始人Guillaume Meyer,在Anthropic宣布计划几天后便发布了一个名为Watermarks Remover的开源项目。该工具通过删除隐藏字符和元数据,并在保持原文含义的同时重新改写文本,以此来破坏可能携带水印的统计性选词模式。该项目开发仅用了约 5 小时,在GitHub上迅速获得了超过1. 4 万个Star,不过Meyer也坦言该工具并不能保证100%彻底移除水印。

Meyer公开表示,自己虽然支持内容归属标注,但反对这种把作者身份简单定性为非黑即白的非理性水印技术。与此同时,提供AI教育服务的Sabrina Ramonov在社交平台上表示,她开发了一款免费的浏览器端Watermark Remover,宣称可从文本、PDF、Word文档、网页、图片及数据文件中清除隐藏的AI标记。常驻东京的软件开发者Ansh Aneja也在Anthropic宣布功能的当天开发了专门针对Claude的水印移除工具,随后又发布了本地开源版本MarkScrub,据称在一天之内用户量就实现了大幅增长。

从技术和法律层面来看,这些AI水印移除工具目前处于一个微妙的灰色地带。苏黎世联邦理工学院研究员Thibaud Gloaguen指出,这些工具再次体现了水印技术长期存在的局限性,即总会有办法通过重新措辞等方式移除水印。

在法律法规方面,欧盟《人工智能法案》要求AI服务提供商的内容标记系统能够抵御常见的修改和对抗性操作,并将移除或修改列为应评估的潜在威胁,但法案本身并没有明确禁止第三方开发或尝试移除AI水印。不过,法律专家指出,如果用户利用这类工具将AI生成的内容恶意伪装成人类创作,就可能违反Anthropic的使用政策,因为其条款禁止用户冒充人类。随着Anthropic计划在下一代模型发布时同步推出文本检测API,并逐步将水印功能推广至旧款模型,围绕AI水印与去水印工具的博弈未来仍将持续升级。