OpenAI將加「文字浮水印」 ChatGPT生成內容未來可被辨識

by 秦 宛萱

為了遵循自8月2日生效的《歐盟人工智慧法案》(EU AI Act)透明度規範,OpenAI正式發表名為「textGrain」的文字隱形浮水印技術,使AI生成的文字內容能以機器可讀的方式被辨識標記。

這項隱形浮水印機制預計於未來數週內,陸續推行至歐盟地區所有方案的ChatGPT與Codex用戶。針對全球API開發者,OpenAI則自即日起提供可手動選擇開啟的設定,目前並未將其設為全球預設功能。

改變微觀選字 複製貼上也能被辨識

與傳統視覺圖像浮水印不同,textGrain並不會在文章中印上「AI生成」等直觀字眼。根據《TechCrunch》報導,該技術是在模型進行下一個詞彙預測時,透過秘密金鑰對詞彙選擇進行微調,嵌入人眼無法察覺的統計特徵。

由於隱形浮水印直接融入於選字與語句結構之中,使用者即便將ChatGPT產生的文章複製並貼上至其他文件,隱藏特徵依然會跟隨文字被完整保留。

OpenAI在基準測試中指出,開啟浮水印並不會降低模型的輸出品質或語意表達能力,甚至是略有提升。

改字、短文與數學 恐降低偵測率

然而,此技術並非毫無破綻,雖隱形浮水印能抵抗直接複製,但只要經過人為修改,偵測效果便會大幅下滑。

OpenAI官方測試顯示,在400個字的段落文章中,若將10%的單字替換成同義詞,偵測率會從92%降至66%;若替換25%的單字,偵測率更會驟降至17%。

此外,若是篇幅較短的文本,或是選字彈性極限的領域,如數學解題,偵測的準確度也會明顯降低。

沒發現浮水印不等於人類原創 偵測工具暫不對外開放

鑑於技術仍存在誤報與漏報的風險,OpenAI表示,目前暫不向大眾公開偵測工具,僅限經核准的研究人員與專業機構申請使用,以進一步評估其可靠性。

OpenAI同時提醒,偵測器「未發現浮水印」並不代表文章必定由人類親手撰寫,內容可能因篇幅過短、經過大幅改寫,或是由其他未標記的AI模型所生成。

同時,浮水印僅能代表OpenAI系統曾處理或生成該段文字,無法衡量人類在創作過程中的參與程度與編輯貢獻,亦無法作為判斷法律著作權歸屬、驗證事實真偽或辨識使用者身分的依據。

曾憂用戶流失而推辭 AI巨頭迎戰歐盟法規

Anthropic早在兩個月前便已全面為Claude生成的文字加上浮水印,當時曾引發部分使用者強烈反彈,認為AI僅是輔助工具,強制標記有損創作自主權。

事實上,外媒報導,OpenAI早於2024年就已開發出浮水印技術,但過去因擔心使用者會轉向無浮水印的競爭對手產品,因而遲遲未正式推出。

根據《The Verge》報導,OpenAI聲稱textGrain的偵測表現已達到或超越Google DeepMind的SynthID文字浮水印技術,顯示出各家AI巨頭在合規與內容溯源技術上的激烈角逐。

你可能會喜歡