好好好!A社,你的剋星來了:
萬能的開發者老哥,已經光速搓出水印移除skill。
沒想到吧?你有張良計,我有過牆梯。
項目名稱也很直給,就叫watermarks-remover(水印移除器)。
上線僅一天,直接爆爆爆爆火!GitHub狂攬2.6k stars。
原作者Guillaume Meyer的𝕏推文,瀏覽量也眼瞅著要衝破200萬了。
嚯!原來大家都在悶聲發大財啊(doge)
而且人老哥有多靠譜呢,不僅把橙色小螃蟹給俘虜了,就連在一旁觀望的Gemini、OpenAI也沒放過…..
都給我一鍵消除哈。
不過老哥溫馨提醒,這玩意兒也不是萬能的。有些東西能洗,有些只能賭一把嘍。
Be like就有網友曬圖:Claude直接拒絕了你的請求~
原因也很簡單,現在A社壓根還沒公佈水印技術,都是網友自發在猜:
猜對了,One Shot,One Kill!
猜錯了,Game Over!
不過問題不大,反A鬥士已經全員出動,接下來只管follow。
gogogo,水印移除skill
還真別說,這老哥手速快到離譜。
A社剛宣佈要在新款Claude的生成文字中嵌入隱形水印,第二天,skill就被造出來了。
光一天時間,就更新了四個版本。
按照Anthropic的官方說法,新水印會直接進入文字,複製貼上也會跟著走,經過一定程度的編輯後仍可能保留。
Claude生成的PNG、JPG、SVG等檔案,還會攜帶C2PA數位簽名中繼資料。
watermarks-remover目前主要針對的就是這裡的中繼資料,內含三層清洗手段。
第一層,是隱藏的Unicode字元。
具體包括零寬空格、零寬連接符、文字方向控制符和特殊空格等。它們夾在文字中間不佔寬度,人眼看起來一切正常,程序卻能讀出多餘的Unicode碼點。
這種也最好處理,只需要逐個檢查字元,發現異常、直接刪除,也是當前skill確定完成的真·擦除。
第二層,是檔案裡的C2PA、EXIF、XMP以及文件屬性。
skill支援PNG、JPEG、SVG、PDF、DOCX、ODT、HTML和Markdown等格式,可以把檔案來源資訊碼掉。
第三層,才是最麻煩的統計(token採樣)文字水印。
這也是網友們主要猜測的A社水印技術,水印會分散在全文文字中。
老哥表示,後續將針對性給出解決方案。
目前skill採取的辦法有點取巧的意味在,直接是呼叫另一個模型,對原文進行大幅改寫、回譯或者重新措辭,嘗試破壞原有的統計規律。
這樣做,到底能不能消除,就純看歐氣了。
BTW,作者建議,最好別用原廠模型。
拿Claude重寫Claude文字,很可能剛洗完,又被Claude蓋了一道章。
這找誰說理去(攤手.GIF)
好消息是,skill支援接入本地Ollama或相容OpenAI介面的模型,效果並非精準移除,只能說盡力干擾,因人而異。
還需要等等A社公佈官方檢測器,或者善良的第三方工具。
Claude的水印技術,OpenAI早試過了
至於Claude用了啥秘密手段?網友們各有各的猜測,這裡po一個被提名最多的KGW。
GPTZero的CTO Alex Cui專門發了一篇長帖解釋這套機制。
他認為,前沿模型若想低成本、即時地流式輸出水印,大機率會參考KGW這類技術。
已知大模型每生成一個Token,都要從一堆候選詞中選擇下一個。
加入水印後,系統會把已經生成的Token與私有金鑰放在一起,計算出一個隨機雜湊值,再根據它調整下一個Token的採樣機率。
說白了,就是把候選詞隨機分成“綠名單”和“紅名單”,然後偷偷給綠名單加分。
如果單看一個詞,啥也看不出來。但等讀完一篇文章,落入綠名單中的Token超過了50%,就會聲稱文字帶水印。
所以這種水印不藏在格式裡,也不是刪除幾個零寬字元就能解決。
想打散,就得把相當一部分句子重新寫掉。最後很可能水印淡了,文字也淡了。
更有意思的是,OpenAI早就測試過類似方案。
2023年,OpenAI承認已開發出一種文字水印方法,內部測試精準率很高,也能抵抗局部改寫。
但它一直沒發,因為OpenAI內部調查發現,接近30%的受訪使用者都表示:
只要ChatGPT敢加水印,我就跑去對家模型。
非常真實,我隨一個+1。
哦對了,Gemini也整出了類似的水印技術,也沒發……
該說不說,還得是這些模型廠商雞賊啊,就A社頭鐵,先發為敬。
One More Thing
不過,等A社的水印反響出來後,OpenAI、Google、Meta估計也很快就跟上。。。
它們可都簽了歐盟的《AI法案》,其中強制規定,需要為AI生成內容提供機器可讀標記和檢測方案。
但是!xAI沒簽。
幹得好,馬斯克!
Grok 4.6剛打了個漂亮翻身仗,我實名支援Grok崛起! (量子位)
