Anthropic幹了一件讓全體用戶暴躁的事。
8月中旬,他們宣佈要給所有的生成產物都打上水印,包括文本和圖片。這種水印對人類來說隱形,卻能被檢測器讀出來。
圖片水印早已有之,給文本打水印之前沒大規模推廣。以後,用Claude寫工作總結?打上。做中英翻譯?打上。檢查語病語法?打上。寫代碼?打上!
一羣人怒了:憑什麼啊?雖然我是用了AI,但它的貢獻可能只是一小部分 ,跟我自己的腦力勞動相比微不足道。那把產出物全打上水印,算不算搶我成果?檢測器能測明白嗎,誤殺率有多少 ?如果領導、客戶把我交出去的東西一過檢測器,發現裏面全是AI水印,用各種理由不給我發錢了,誰承擔損失 ?
幾天之內,多款“水印去除器”在GitHub發佈。最受歡迎的是法國開發者Guillaume Meyer做的Watermarks remover,它被星標了1.9萬次,在X上也有2萬收藏。
![]()
好好的,Anthropic爲什麼在兩週前挑逗大衆情緒呢?
歐盟動手在前,Anthropic不得不跟
歐盟的《人工智能法案》已經在8月2日生效。它的第50條要求,生成式AI的輸出必須帶機器可讀的標記 ,目的是讓人們能夠識別自己何時正與AI互動,以及所接觸的內容是否由AI生成或修改,從而減少欺騙、操縱和虛假信息 。法案特地要求“足夠可靠、有效、穩健、可互操作”。
記住這4個詞。後面你會發現,這個要求常常被打臉。
![]()
《人工智能法案》的名字非常簡潔:EU AI Act丨歐盟
具體來說,8月2日後發佈的新模型必須給所有生成物打上水印;8月2日前就上線的舊模型,包括Sonnet 5、Fable 5,都有過渡期,到今年12月2日前能上線水印即可。
違反法案會有一系列處理措施,最高可能罰款1500萬歐元,或全球年營業額的3%,哪個高就按哪個罰。
目前有100多家機構簽署簽署了配套的《AI生成內容透明度行爲準則》,包括谷歌、Meta、微軟、Mistral、OpenAI、聯想等。xAI和DeepSeek、字節等中國代表性AI企業暫時沒簽。
繞過水印的第一件事,是知道它長什麼樣
這種水印對人類隱形,遠不如“不是……而是……”這種AI拉屎句式那麼明顯。
Claude給圖像附加的來源元數據 ,遵循內容來源與真實性聯盟(C2PA)開放標準,因此在非專業用途上暴力破解就夠 ,圖片格式轉換、手機截圖、哪怕發微信再另存都行。
![]()
C2PA檢測器可以讀出很多信息,比如圖片是哪個AI生成的丨C2PA Viewer
而給文本打水印的技術SynthID‑Text ,雖然早就由谷歌在2024年發佈,但目前應用得還不算太廣。原理簡單來說是:
模型每寫一個詞,都會先按正常概率抽出一組候選詞,越合適的詞分數越高。SynthID再根據密鑰和上文,給候選詞打上看不見的隨機分,讓它們像參加淘汰賽一樣兩兩較量,最後的勝者被寫進下文。單看一個詞沒有任何異常,但在一定長度的文本里,某種規律就會累積起來,形成記號 。
檢測,則使用同一把密鑰反向進行。
既然水印的關鍵在於AI選詞有"規律",那麼破解的核心也就兩個字:換詞。
去水印,也沒那麼麻煩
最直接的方法是把文字改寫一遍。注意,是換詞複述,而不是照着原文自己重新打一遍,當然也不能讓Claude自己去改寫自己。
省力版·重寫,就是上古手搓論文時期的防查重方法:把一段文字丟進翻譯器 ,中文轉英語轉德語再翻譯成中文,幾輪倒騰下來,查重系統就檢測不到了。
如果你不想自己搞,那當然你可以用AI去改寫和翻譯 ,也可以讓工具幫你使喚AI。
Watermarks Remover就是自動使用不帶水印的模型生成多個重寫版本,替換同義詞,並對內容進行微調。用幾個帶水印的模型,相互改寫,也能通過魔法對沖消水印。
執行,草臺班子
監管落地得這麼急,可現在根本執行不了。
谷歌算是走得最快的,它已經讓Gemini給多種輸出形式打水印,也開源了SynthID‑Text的生成與檢測框架,但尚未有針對性檢測工具。OpenAI目前給圖像和音頻加了水印,沒來得及管文本。Anthropic的水印和檢測器都在路上。Meta、微軟等公司的進度更加落後。
![]()
OpenAI溯源信號(水印)現狀丨OpenAI官方
連檢測器都沒有,那歐盟要求將來“用一個檢測器,就能檢測出各家水印”,還稍微有點難辦。
更尷尬的是,歐盟27個成員國裏,不是各個都已經指定好了負責監管的機構。
所以現在就是這麼個情況:官方需求已經下了,才發現執行能力、標準、工具甚至人員都還沒對齊。“讓人們能夠識別自己何時正與AI互動,以及所接觸的內容是否由AI生成或修改,從而減少欺騙、操縱和虛假信息”,這場聲勢不小的水印運動出發點是好的,但能否達到目標,是否會有其他地區跟進,尚不得而知。
更多遊戲資訊請關註:電玩幫遊戲資訊專區
電玩幫圖文攻略 www.vgover.com
