外媒:Claude加浮水印後催生去浮水印騙局
Anthropic 本週宣布,開始為 Claude 產生的文字加入隱形浮水印。 外媒稱,此做法很快帶動了另一類工具升溫:號稱能清除 AI 浮水印的應用與服務。
文章認為,問題不僅在於需求上升,更在於大量產品藉機誇大能力。 有些工具宣稱可以穩定移除浮水印,有些則把「去識別」「改寫」「降 AI 痕跡」混為一談,甚至可能夾帶惡意軟體,利用用戶急於規避檢測的心理牟利。
按照 Anthropic 的說明,這類文本水印並不是插入特殊字符,也不是加入肉眼可見的標記,而是在生成過程中調整詞語選擇,形成可被特定工具識別的統計模式。 文字表面看起來正常,讀者通常無法直接判斷是否有浮水印。

文章舉例稱,一句話往往有多種近義表達。 模型生成時,可能會依特定機率選擇某一類替代表達。 單看一句話很難發現異常,但把整段文字放在一起分析,就可能辨識出這種模式。
外媒指出,文字浮水印與圖片浮水印不同,穩定性較依賴原文結構。 只要使用者對內容進行改寫、替換詞語、拼接進更長文本,或再次交給其他 AI 重寫,原有統計特徵就可能被打散。
這意味著,許多「去浮水印」並不一定依賴專門技術。 普通編輯、本地改寫,甚至二次生成,都可能讓偵測結果下降。 也正因如此,部分商家把常見改寫功能包裝成“專業去浮水印”,宣傳與實際能力並不相稱。
文章認為,隨著更多模型服務商嘗試給 AI 輸出加標記,圍繞「去浮水印」的灰色服務還會繼續增加。 風險主要有三類:
- 虛假承諾,宣稱可徹底清除所有模型水印
- 混淆概念,把改寫工具包裝成檢測規避工具
- 借軟體下載或插件安裝投放惡意程式
外媒的核心判斷是,文字水印軟體下載或插件安裝投放惡意程式
外媒的核心判斷是,文字水印軟體下載或外掛程式安裝投放惡意程式
外媒的核心判斷是,文字浮水印本身並非不可破,而圍繞擴散技術本身可能會更快的行銷技術本身。 對用戶來說,眼下更現實的問題不是“能否完全去除”,而是如何識別誇大宣傳和可疑軟體。
登入回覆
登入分享您的看法評論
相關文章