Claude隱形水印被光速破解,GitHub一天狂攬2.6k星

AI速讀
近日,一名開發者在 GitHub 發布名為『watermarks-remover』的工具,旨在移除 Claude AI 的隱形水印,上線一日即獲 2.6k 星。該工具透過清理 Unicode 特殊字元、刪除 C2PA 中繼資料及利用他模改寫來對抗水印。分析指出,AI 水印核心在於調整 Token 採樣概率(KGW 技術),雖 OpenAI 等巨頭亦有類似方案,但因顧慮用戶體驗而猶豫。此次事件凸顯了 AI 廠商在落實歐盟 AI 法案監管要求與維持用戶留存之間的矛盾。

好好好!A社,你的剋星來了:

萬能的開發者老哥,已經光速搓出水印移除skill

沒想到吧?你有張良計,我有過牆梯。

項目名稱也很直給,就叫watermarks-remover(水印移除器)。

上線僅一天,直接爆爆爆爆火!GitHub狂攬2.6k stars

原作者Guillaume Meyer的𝕏推文,瀏覽量也眼瞅著要衝破200萬了。

嚯!原來大家都在悶聲發大財啊(doge)

而且人老哥有多靠譜呢,不僅把橙色小螃蟹給俘虜了,就連在一旁觀望的GeminiOpenAI也沒放過…..

都給我一鍵消除哈。

不過老哥溫馨提醒,這玩意兒也不是萬能的。有些東西能洗,有些只能賭一把嘍。

Be like就有網友曬圖:Claude直接拒絕了你的請求~

原因也很簡單,現在A社壓根還沒公佈水印技術,都是網友自發在猜:

猜對了,One Shot,One Kill!

猜錯了,Game Over!

不過問題不大,反A鬥士已經全員出動,接下來只管follow。

gogogo,水印移除skill

還真別說,這老哥手速快到離譜。

A社剛宣佈要在新款Claude的生成文字中嵌入隱形水印,第二天,skill就被造出來了。

光一天時間,就更新了四個版本

按照Anthropic的官方說法,新水印會直接進入文字,複製貼上也會跟著走,經過一定程度的編輯後仍可能保留。

Claude生成的PNG、JPG、SVG等檔案,還會攜帶C2PA數位簽名中繼資料

watermarks-remover目前主要針對的就是這裡的中繼資料,內含三層清洗手段。

第一層,是隱藏的Unicode字元。

具體包括零寬空格、零寬連接符、文字方向控制符和特殊空格等。它們夾在文字中間不佔寬度,人眼看起來一切正常,程序卻能讀出多餘的Unicode碼點。

這種也最好處理,只需要逐個檢查字元,發現異常、直接刪除,也是當前skill確定完成的真·擦除。

第二層,是檔案裡的C2PA、EXIF、XMP以及文件屬性。

skill支援PNG、JPEG、SVG、PDF、DOCX、ODT、HTML和Markdown等格式,可以把檔案來源資訊碼掉。

第三層,才是最麻煩的統計(token採樣)文字水印。

這也是網友們主要猜測的A社水印技術,水印會分散在全文文字中。

老哥表示,後續將針對性給出解決方案。

目前skill採取的辦法有點取巧的意味在,直接是呼叫另一個模型,對原文進行大幅改寫、回譯或者重新措辭,嘗試破壞原有的統計規律。

這樣做,到底能不能消除,就純看歐氣了。

BTW,作者建議,最好別用原廠模型

拿Claude重寫Claude文字,很可能剛洗完,又被Claude蓋了一道章。

這找誰說理去(攤手.GIF)

好消息是,skill支援接入本地Ollama或相容OpenAI介面的模型,效果並非精準移除,只能說盡力干擾,因人而異

還需要等等A社公佈官方檢測器,或者善良的第三方工具。

Claude的水印技術,OpenAI早試過了

至於Claude用了啥秘密手段?網友們各有各的猜測,這裡po一個被提名最多的KGW

GPTZero的CTO Alex Cui專門發了一篇長帖解釋這套機制。

他認為,前沿模型若想低成本、即時地流式輸出水印,大機率會參考KGW這類技術。

已知大模型每生成一個Token,都要從一堆候選詞中選擇下一個。

加入水印後,系統會把已經生成的Token與私有金鑰放在一起,計算出一個隨機雜湊值,再根據它調整下一個Token的採樣機率。

說白了,就是把候選詞隨機分成“綠名單”和“紅名單”,然後偷偷給綠名單加分

如果單看一個詞,啥也看不出來。但等讀完一篇文章,落入綠名單中的Token超過了50%,就會聲稱文字帶水印。

所以這種水印不藏在格式裡,也不是刪除幾個零寬字元就能解決。

想打散,就得把相當一部分句子重新寫掉。最後很可能水印淡了,文字也淡了。

更有意思的是,OpenAI早就測試過類似方案

2023年,OpenAI承認已開發出一種文字水印方法,內部測試精準率很高,也能抵抗局部改寫。

但它一直沒發,因為OpenAI內部調查發現,接近30%的受訪使用者都表示:

只要ChatGPT敢加水印,我就跑去對家模型。

非常真實,我隨一個+1。

哦對了,Gemini也整出了類似的水印技術,也沒發……

該說不說,還得是這些模型廠商雞賊啊,就A社頭鐵,先發為敬。

One More Thing

不過,等A社的水印反響出來後,OpenAI、Google、Meta估計也很快就跟上。。。

它們可都簽了歐盟的《AI法案》,其中強制規定,需要為AI生成內容提供機器可讀標記和檢測方案。

但是!xAI沒簽。

幹得好,馬斯克!

Grok 4.6剛打了個漂亮翻身仗,我實名支援Grok崛起! (量子位)