Anthropic給AI寫的字都打上了-暗號,這事沒那麼簡單

AI速讀
Anthropic 宣布將在 Claude 模型生成的文字中嵌入不可見水印,並於檔案中加入 C2PA 溯源標記,以符合歐盟《人工智慧法案》的透明度義務。此舉雖為合規之舉,但實質上是將 AI 內容的「可追溯性」制度化。儘管該技術在面對大幅改寫時存在失效風險,且可能導致部分在意標籤的專業用戶流向開源模型,但其核心意義在於為未來的智慧財產權或法律糾紛建立證據鏈。這標誌著 AI 競爭已從單純的性能比拼,演進至責任邊界與信任成本的重新定義。

聚焦

從2026年8月2日起,Anthropic旗下所有新發佈的Claude模型,生成的文字裡都會被嵌入一層人眼看不見的水印。檔案類輸出則會附帶C2PA標準的溯源中繼資料。官方說法是為了滿足歐盟《人工智慧法案》第50條的透明度要求,但這件事背後牽扯的遠不止合規兩個字。

這不是一次產品更新公告,是一次行業等級的訊號彈。

一、時間線:一份檔案捅破的窗戶紙

Claude模型自2026年8月2日起在歐盟範圍內發佈的版本,將在推出時就支援機器可讀的標記功能。生成的文字會攜帶嵌入式水印,生成的檔案在支援的格式下會附帶數位簽名的溯源中繼資料。這份說明來自Claude官方幫助中心,更新時間是8月11日,距離生效日已經過去了九天,屬於事後補公告。

監管的源頭很清楚。《人工智慧法案》要求生成合成內容(比如深度偽造)的AI系統必須標記其輸出為人工合成,這一條款正是第50條。第50條的透明度義務已於2026年8月2日正式生效,不合規最高可面臨1500萬歐元罰款或全球年營業額3%的處罰,以較高者為準。

時間軸速覽

  • 8月2日:歐盟AI法案第50條透明度義務正式生效
  • 8月2日起:所有在歐盟新發佈的Claude模型自動帶水印
  • 8月10日(周一):Anthropic更新幫助中心文件,正式對外確認
  • 8月11日:TechCrunch、Axios、路透社系列媒體跟進報導
  • 未來:老模型的水印支援仍在開發中,暫無明確時間表

值得玩味的是這個"全球範圍"。《人工智慧法案》理論上只約束在歐盟境內使用的AI系統,條文字身並沒有強制要求公司把水印功能延伸到新加坡或聖保羅發起的API呼叫上。但Anthropic選擇了一刀切,全球統一部署,不分地域。這不是被迫合規的最小化操作,是主動把標準做成了全球預設值。

二、水印到底是怎麼回事

拆開來看,這套機制分兩條腿走路。

文字水印:當支援的Claude模型生成文字時,會把一層不可見的水印直接編織進文字本身,使用者看不到,也不會改變回答的含義、質量或可讀性。因為水印是文字的一部分,複製貼上到別處時會跟著一起走,經過一定程度的編輯之後也可能依然存在。

檔案水印:新生成的圖片、文件等檔案類型,會採用C2PA這個開放的內容溯源標準,寫入數位簽名的中繼資料。

這兩套系統的"命門"完全不同,我用一張表說清楚:

維度
文字水印
檔案水印(C2PA)
原理
統計學層面的不可見模式
數位簽名中繼資料
是否影響內容
不影響,肉眼不可見
不影響內容本身
抗編輯能力
輕度編輯可能保留,重寫基本失效
格式轉換、截圖、另存後大機率丟失
覆蓋範圍
8月2日後發佈的新模型
支援的檔案格式,如svg、png、jpg
老模型是否覆蓋
暫不覆蓋,開發中
暫不覆蓋,開發中

警示

別把這個水印當成"照妖鏡"。它證明的是內容"被Claude處理過",不是"由Claude原創"。有人拿Claude翻譯、潤色、格式化一份人寫的稿子,最後文字依然會帶上Claude的印記。反過來,一段完全由AI生成的文字,只要經過充分改寫、拼接,或者篇幅太短,水印也可能檢測不出來。別拿檢測結果當鐵證。

如果文字被大幅重寫、和其他內容混排,或者篇幅太短,水印就有可能檢測不到。這句話說得很實在,等於官方自己承認了這套系統的天花板不高。檔案的標記也可以通過格式轉換、重新保存、截圖等操作被抹除,一份曾經帶有Claude印記的文件或圖片,編輯或轉換之後可能就再也看不出任何痕跡了。

三、Anthropic不是一個人在戰鬥

除了Anthropic,Black Forest Labs、Google、Meta、微軟、OpenAI和Synthesia等公司也已承諾遵守歐盟這套行為準則。但落地速度差距明顯。

公司/平台
動作
覆蓋範圍
Anthropic
文字+檔案雙水印,全球部署
8月2日後新模型
OpenAI
已提交合規方案
目前的水印工作主要集中在圖片和音訊,文字水印尚未大規模落地
Suno
音樂平台加標記
上週宣佈將標記平台上生成的音軌,回應此前一系列法律訴訟
Substack
接入第三方檢測
上個月與Pangram合作,標記AI生成內容
LinkedIn
內測舉報功能
正在測試"疑似AI水貨"按鈕
Snap
限流處理
已停止在主資訊流中推廣AI生成視訊


一個很直白的對比:Anthropic做到了OpenAI承認自己還沒做到的事,但代價是配套的檢測工具還沒上線,改寫就能讓這個訊號失效。換句話說,Anthropic搶跑了公關敘事,但技術閉環還沒跑完。

洞察

這裡有個很少人會去想的問題:水印這件事,本質上是一場"信任成本"的轉移。以前AI公司只需要對生成質量負責,現在多了一層——對生成內容的"可追溯性"負責。這不是技術升級,是責任邊界的重新劃分。誰先做,誰就先把自己架在了監管的顯微鏡下,別人跟不跟,反而成了次要問題。

四、這事真正刺痛誰

大部分報導都在講合規和技術,但真正被戳到的是使用場景。

對企業傳播團隊來說,如果只是用Claude來清理格式、翻譯或潤色一份本來由人撰寫的新聞稿,最後這份文件也會被打上AI簽名。這意味著什麼?意味著"人寫AI改"和"AI從頭寫"在水印系統眼裡沒有區別。對嚴肅內容生產者來說,這是一記悶棍。

相關消息在預測市場平台上引發的一份摘要瀏覽量超過61萬次,付費使用者的反應普遍偏負面。憤怒背後的邏輯其實很樸素:沒人喜歡自己的工作流程被貼上不受自己控制的標籤。

這一舉措可能會進一步提升開源權重模型的吸引力,也可能讓部分不希望內容消費者知道生成溯源的Claude使用者感到被冒犯。這句判斷值得單獨拎出來說。水印這件事,短期看是合規動作,長期看可能是一次隱性的使用者分流——願意透明的留下,介意透明的轉向開源模型或者更"松"的平台。

五、跳出合規敘事看這件事

大多數報導停在"合規"和"技術細節"兩層,但有幾個角度值得多想一步。

第一,水印的真正價值不在於"抓AI造假",而在於給未來的責任認定提供一個可追溯的錨點。想像一下幾年後的智慧財產權糾紛、學術不端調查、甚至新聞真實性爭議,一份能證明"這段文字經過AI處理"的中繼資料,可能比現在任何一種AI檢測工具都更有法律效力。這是一份為未來訴訟預留的證據鏈,而不是給今天的讀者提供的辨偽工具。

第二,Anthropic同時以生成式AI模型提供商和生成式AI系統提供商兩重身份簽署了這份行為準則,這兩頂帽子對應的義務並不完全相同。大部分企業客戶如果把Claude接入自己的產品,不能簡單套用Anthropic的合規動作當擋箭牌,Anthropic明確提示,部署方需要自行評估第50條對自己產品的具體要求。這意味著水印上線不是終點,是一堆下游企業需要重新審視自己合規義務的起點。

第三,一個容易被忽略的悖論:水印越"隱形"、越不影響內容質量,它就越容易在傳播過程中被無意識地丟失。這不是bug,是設計初衷決定的宿命。一套真正"打不掉"的水印,必然會犧牲部分內容的自然度,而Anthropic選擇了自然度優先,也就意味著從設計第一天起,這套系統就註定是"有勝於無",而不是"萬無一失"。

六、寫在最後

監管的靴子已經落地,但檢測的地基還沒打完。這不是一次憑空出現的產品決策,是Anthropic對歐盟AI法案第50條第2款透明度行為準則的正式回應。接下來幾個月,值得盯著看的不是"水印有沒有用",而是"檢測工具什麼時候真正上線",以及"其他簽了字的公司還能拖多久"。

一場關於AI內容溯源的軍備競賽,才剛剛吹響第一聲哨。

一句話總結

水印證明的是內容被處理過,不是內容由誰原創,這中間的空隙,才是接下來所有爭議真正的戰場。(芯在說)