OpenAI 將為歐盟 ChatGPT 文字加浮水印,坦言改寫即可移除

Elponcrab
分享
OpenAI 將為歐盟 ChatGPT 文字加浮水印,坦言改寫即可移除

OpenAI 10 月 5 日發布官方說明,為符合歐盟《人工智慧法》(AI Act)要求生成式 AI 業者讓產出文字可被機器辨識的規定,未來幾週將在歐盟為 ChatGPT 與 Codex 的合格文字輸出加上隱形浮水印。全球的 API 客戶即日起可自行選擇開啟文字浮水印,預設維持關閉。

OpenAI 同時坦言,文字浮水印與偵測仍是早期技術、限制明顯,因此偵測工具一開始只開放給經核准的研究人員與專業機構申請使用,不對大眾公開。

只在歐盟預設開啟,API 客戶全球可選用

根據說明,浮水印將套用在歐盟所有方案的合格 ChatGPT 與 Codex 用戶,OpenAI 表示上線時不會把文字浮水印設為全球預設,採區域性做法是為了從實際使用與回饋中學習。API 方面,全球客戶即日起可為特定模型的輸出開啟浮水印,OpenAI 也正與雲端合作夥伴洽談,未來幾週讓透過其服務存取 OpenAI 模型的輸出同樣可加浮水印。

廣告 - 內文未完請往下捲動

偵測工具會回報文字中是否偵測到 OpenAI 浮水印,但不會識別使用者,也不會揭露提示詞或對話內容。OpenAI 表示,考量漏判與誤判的風險,依照歐盟針對 AI 生成內容的行為準則(Code of Practice),偵測工具初期將逐案核准開放。

改寫四分之一字詞,偵測率從 92% 掉到 17%

OpenAI 的文字浮水印技術名為 textGrain,做法是在模型選字時加入隱形的統計訊號,再由偵測器尋找這個訊號。OpenAI 稱在內部評估中,textGrain 的表現與包括 Google SynthID 在內的其他方法相當或更好,並計畫將技術開源,但強調理想條件下的表現不代表日常使用能可靠偵測。

OpenAI 公布的測試顯示,在誤判率目標 1% 的條件下,心理學這類內容 200 個 token 的段落約有 80% 能偵測到浮水印,400 個 token 的段落約 95%;數學這類用字彈性較小的內容,偵測率明顯更低。編輯也會削弱訊號:400 個 token 的段落若把 10% 的字換成同義詞,偵測率從約 92% 降到 66%,替換 25% 則降到 17%。OpenAI 在 X 上也表示,改寫或翻譯可以完全移除浮水印。

在輸出品質方面,OpenAI 以最新前沿模型 Astra 測試,加浮水印前後在 GPQA Diamond、BrowseComp、DeepSWE 等基準的分數沒有明顯差異,例如 Artificial Analysis 智慧指數分別為 49.57 與 49.76 分。

浮水印不能證明誰寫的

OpenAI 列出浮水印無法回答的問題:它不能衡量人類參與的程度,不能確立著作權或責任歸屬,不能識別使用者,也不能驗證內容是否正確;而沒有偵測到浮水印,也不代表文字是人寫的,因為文字可能太短,可能被編輯或翻譯過,也可能來自其他公司的工具。

OpenAI 表示,目前圖片與音訊的驗證工具(openai.com/verify 與 Content Provenance API)維持公開,圖片也已加入 Content Credentials 與 SynthID 浮水印。對於文字,OpenAI 稱會持續研究浮水印承受編輯與翻譯的能力,並在認為偵測結果能被負責任地解讀時,再擴大偵測工具的開放範圍。

風險提示

加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。