社区所有版块导航
Python
python开源   Django   Python   DjangoApp   pycharm  
DATA
docker   Elasticsearch  
aigc
aigc   chatgpt  
WEB开发
linux   MongoDB   Redis   DATABASE   NGINX   其他Web框架   web工具   zookeeper   tornado   NoSql   Bootstrap   js   peewee   Git   bottle   IE   MQ   Jquery  
机器学习
机器学习算法  
Python88.com
反馈   公告   社区推广  
产品
短视频  
印度
印度  
Py学习  »  Git

Claude隐形水印被光速破解,GitHub一天狂揽2.6k星

量子位 • 4 天前 • 42 次点击  
鹭羽 发自 凹非寺
量子位 | 公众号 QbitAI

好好好!A社,你的克星来了:

万能的开发者老哥,已经光速搓出水印移除skill

没想到吧?你有张良计,我有过墙梯。

项目名称也很直给,就叫watermarks-remover(水印移除器)

上线仅一天,直接爆爆爆爆火!GitHub狂揽2.6k stars

原作者Guillaume Meyer的𝕏推文,浏览量也眼瞅着要冲破200万了。

嚯!原来大家都在闷声发大财啊(doge)

而且人老哥有多靠谱呢,不仅把橙色小螃蟹给俘虏了,就连在一旁观望的GeminiOpenAI也没放过…..

都给我一键消除哈。

不过老哥温馨提醒,这玩意儿也不是万能的。有些东西能洗,有些只能赌一把喽。

Be like就有网友晒图:Claude直接拒绝了你的请求~

原因也很简单,现在A社压根还没公布水印技术,都是网友自发在猜:

猜对了,One Shot,One Kill!

猜错了,Game Over!

不过问题不大,反A斗士已经全员出动,接下来只管follow。

gogogo,水印移除skill

还真别说,这老哥手速快到离谱。

A社刚宣布要在新款Claude的生成文本中嵌入隐形水印,第二天,skill就被造出来了。

光一天时间,就更新了四个版本

按照Anthropic的官方说法,新水印会直接进入文本,复制粘贴也会跟着走,经过一定程度的编辑后仍可能保留。

Claude生成的PNG、JPG、SVG等文件,还会携带C2PA数字签名元数据

watermarks-remover目前主要针对的就是这里的元数据,内含三层清洗手段。

第一层,是隐藏的Unicode字符。

具体包括零宽空格、零宽连接符、文本方向控制符和特殊空格等。它们夹在文字中间不占宽度,人眼看起来一切正常,程序却能读出多余的Unicode码点。

这种也最好处理,只需要逐个检查字符,发现异常、直接删除,也是当前skill确定完成的真·擦除。

第二层,是文件里的C2PA、EXIF、XMP以及文档属性。

skill支持PNG、JPEG、SVG、PDF、DOCX、ODT、HTML和Markdown等格式,可以把文件来源信息码掉。

第三层,才是最麻烦的统计(token采样)文本水印。

这也是网友们主要猜测的A社水印技术,水印会分散在全文文本中。

老哥表示,后续将针对性给出解决方案。

目前skill采取的办法有点取巧的意味在,直接是调用另一个模型,对原文进行大幅改写、回译或者重新措辞,尝试破坏原有的统计规律。

这样做,到底能不能消除,就纯看欧气了。

BTW,作者建议,最好别用原厂模型

拿Claude重写Claude文本,很可能刚洗完,又被Claude盖了一道章。

这找谁说理去(摊手.GIF)

好消息是,skill支持接入本地Ollama或兼容OpenAI接口的模型,效果并非精准移除,只能说尽力干扰,因人而异

还需要等等A社公布官方检测器,或者善良的第三方工具。

Claude的水印技术,OpenAI早试过了

至于Claude用了啥秘密手段?网友们各有各的猜测,这里po一个被提名最多的KGW

GPTZero的CTO Alex Cui专门发了一篇长帖解释这套机制。

他认为,前沿模型若想低成本、实时地流式输出水印,大概率会参考KGW这类技术。

已知大模型每生成一个Token,都要从一堆候选词中选择下一个。

加入水印后,系统会把已经生成的Token与私有密钥放在一起,计算出一个随机哈希值,再根据它调整下一个Token的采样概率。

说白了,就是把候选词随机分成“绿名单”和“红名单”,然后偷偷给绿名单加分

如果单看一个词,啥也看不出来。但等读完一篇文章,落入绿名单中的Token超过了50%,就会声称文本带水印。

所以这种水印不藏在格式里,也不是删除几个零宽字符就能解决。

想打散,就得把相当一部分句子重新写掉。最后很可能水印淡了,文字也淡了。

更有意思的是,OpenAI早就测试过类似方案

2023年,OpenAI承认已开发出一种文本水印方法,内部测试准确率很高,也能抵抗局部改写。

但它一直没发,因为OpenAI内部调查发现,接近30%的受访用户都表示:

只要ChatGPT敢加水印,我就跑去对家模型。

非常真实,我随一个+1。

哦对了,Gemini也整出了类似的水印技术,也没发……

该说不说,还得是这些模型厂商鸡贼啊,就A社头铁,先发为敬。

One More Thing

不过,等A社的水印反响出来后,OpenAI、谷歌、Meta估计也很快就跟上。。。

它们可都签了欧盟的《AI法案》,其中强制规定,需要为AI生成内容提供机器可读标记和检测方案。

但是!xAI没签。

干得好,马斯克!

Grok 4.6刚打了个漂亮翻身仗,我实名支持Grok崛起!

参考链接:
[1]https://x.com/guillaumemeyer/status/2087275734608007415
[2]https://github.com/guillaumemeyer/watermarks-remover
[3]https://x.com/alexcdot/status/2087078010524406137?s=20
[4]https://x.com/max_spero_/status/2086997641297035651?s=20

一键三连「点赞」「转发」「小心心」

欢迎在评论区留下你的想法!

—  —


📪 量子位AI主题策划正在征集中!欢迎参与专题365行AI落地方案,一千零一个AI应或与我们分享你在寻找的AI产品,或发现的AI新动向

💬 也欢迎你加入量子位每日AI交流群,一起来畅聊AI吧~



一键关注 👇 点亮星标

科技前沿进展每日见

Python社区是高质量的Python/Django开发社区
本文地址:http://www.python88.com/topic/199795