Claude 開始替 AI 文字加「隱形浮水印」複製貼上仍可能被辨識

Neo
分享
Claude 開始替 AI 文字加「隱形浮水印」複製貼上仍可能被辨識

Anthropic 今日更新 Claude 官方說明文件,正式揭露其 AI 生成內容標記機制。

未來支援的 Claude 模型不只會在圖片、檔案加入來源資訊,就連一般文字回答本身,也會嵌入使用者肉眼看不見的「浮水印」,即使將文字複製、貼到其他網站,部分標記仍可能保留下來。

這項措施主要是為了配合歐盟《AI Act》Article 50(2) 對 AI 生成內容透明度的要求。

廣告 - 內文未完請往下捲動

Anthropic 已簽署相關實務準則,並表示 2026 年 8 月 2 日之後在歐盟推出的新 Claude 模型,將從上線第一天開始支援機器可讀的 AI 內容標記;而且標記不只適用歐洲,而會隨支援模型擴展至全球 Claude 服務。

Claude 文字也有浮水印,而且複製貼上可能不會消失

Anthropic 表示,Claude 將採用兩套互補機制。

第一種直接作用在文字內容。當支援的 Claude 模型生成文字時,模型會把「不可見浮水印」嵌入輸出之中。使用者肉眼不會看到特殊符號,也不會影響文字原本的語意、品質與可讀性。

比較值得注意的是,這個浮水印不是單純附加在網頁介面上的標籤,而是直接存在生成文字之中。因此使用者把 Claude 回答複製到 Word、社群網站、Email 或其他平台後,浮水印仍可能跟著內容一起移動,甚至經過部分修改後仍有機會被偵測。

Anthropic 強調,浮水印是在「模型層級」加入,因此理論上不論文字是從 Claude 網頁版、API、Claude Code、Claude Cowork 或 Claude Tag 生成,只要使用的是支援模型,都會套用相同標記。

就連透過 AWS、Google Cloud 或 Microsoft Foundry 使用支援的 Claude 模型,文字浮水印同樣會存在。

圖片與檔案採 C2PA 數位簽章

除了文字浮水印,Claude 生成或處理部分檔案時,Anthropic 也會加入具數位簽章的來源 metadata。

目前官方舉例包括 SVG、PNG、JPG 等格式,將採用由 Coalition for Content Provenance and Authenticity 推動的 C2PA 開放標準。

簡單來說,C2PA 有點像替數位內容附上一張「來源履歷」。如果檔案帶有有效的 Claude 簽章,外部工具未來便有機會判斷該檔案是否曾經由 Claude 處理,以及檔案之後是否遭到竄改。

不過 Anthropic 也提醒,部分雲端平台或檔案格式可能暫時不支援簽署 provenance metadata,因此文字浮水印與檔案來源標記的覆蓋範圍不一定完全一致。

未來甚至可能直接檢測「這是不是 Claude 寫的」

Anthropic 接下來另一項重要工作,是提供使用者及第三方偵測 Claude 標記的方式。

官方表示,目前正在開發相關檢測機制,讓外部能判斷一段文字或檔案是否帶有 Claude 支援的浮水印或來源 metadata,詳細技術文件之後才會公布。

換句話說,未來學校、媒體平台、企業內部系統或內容驗證工具,理論上都有可能直接檢查一段文字是否帶有 Claude 的機器可讀標記。

這也與過去常見的「AI Detector」有明顯差異。傳統 AI 偵測工具通常是透過文體、詞彙機率或模型預測來猜測文章是不是 AI 寫的;Claude 的做法則是由模型生成時主動埋入可偵測訊號。

但改寫、翻譯仍可能把浮水印洗掉

Anthropic 同時承認,這套機制並不是百分之百可靠。

例如文字如果經過大量改寫、paraphrase、翻譯,或與其他內容混合,浮水印可能無法再被可靠辨識;文字太短,也可能缺乏足夠訊號。

檔案方面,如果經過重新儲存、格式轉換、截圖等操作,原本的 metadata 也可能被移除。

因此「沒有偵測到 Claude 浮水印」並不能直接證明內容一定不是 AI 生成。

反過來說,偵測到 Claude 標記,也不代表整篇內容就是 Claude 原創。使用者可能只是把自己撰寫的文章交給 Claude 校稿、翻譯或摘要,輸出結果仍可能帶有 Claude 標記。

舊 Claude 模型也會逐步補上

目前新制度主要涵蓋 2026 年 8 月 2 日之後推出的 Claude 模型,Anthropic 表示,較早推出的模型仍處於過渡期,公司也正在逐步加入相關標記功能。

風險提示

加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。