OpenAI 推出隱形文字浮水印 textGrain!歐盟 ChatGPT 與 Codex 先行導入

為了遵循歐洲聯盟(EU)的《人工智慧法案》(AI Act)規範,OpenAI 宣布推出名為 textGrain 的文字浮水印技術,並於未來數週內優先在歐盟地區的 ChatGPT 與程式碼撰寫工具 Codex 導入。這項技術能在不變更字面意義的前提下,為 AI 生成內容加上可追溯的統計特徵,幫助外部工具辨識內容來源。

微調選字機率植入統計訊號 textGrain 技術解析

這項被命名為 textGrain 的文字浮水印機制,運作原理並非在文章中插入隱藏字元、特殊空格或肉眼看不見的符號,而是直接在模型生成文字的過程中,微幅改變字詞選擇的機率分佈。透過這種方式,生成的整段文本會形成特定的隱形統計模式,再由專用的檢測工具來分析並判斷該段內容是否出於 OpenAI 之手。

在效能表現方面,OpenAI 針對多項標準基準測試進行比對,包含智能指數(Artificial Analysis Intelligence Index)、程式能力測試(Terminal-Bench)與專業領域評測(GPQA Diamond)等,結果顯示加載浮水印後的模型輸出在分數上與未加水印版本並無實質差異,顯示該技術不會犧牲輸出的品質或邏輯表現。

技術限制顯著:大幅改寫與短文將降低辨識準確度

儘管文字浮水印能作為來源判斷的輔助依據,OpenAI 也坦言現有技術仍存在嚴格的限制。由於選字機率仰賴一定程度的篇幅累積,因此在字數較短的段落,或是數學公式等用語彈性極低的專業領域中,檢測系統容易出現誤判或無法辨識的情況。

此外,內容一旦經過二次編輯或改寫,浮水印訊號將會顯著被削弱。根據官方測試資料,在一篇約 400 個詞元(Token)的段落中,若將 10% 的詞彙替換為同義詞,檢測成功率會從 92% 降至 66%;若更換比例提高至 25%,偵測率更會銳減至 17%。同時,OpenAI 強調浮水印無法衡量人類參與創作的比重,亦無法用於驗證資訊真實性、確定著作權歸屬或識別特定使用者身分。

這代表什麼

這項發展意味著 AI 生成內容的合規與溯源管理,已經從過去常見的圖像、影片與語音,正式跨入技術難度更高的純文字領域。對於台灣企業與專業從業者而言,雖然目前台灣尚未強制要求生成式文字標註浮水印,但在全球化業務或跨國供應鏈中,使用 AI 輔助撰寫行銷文案、報告或軟體程式碼時,必須更加關注各國監管法規對內容標記與可追溯性的要求。

此外,由於文字浮水印極易因潤飾或重組而失去效果,企業不應將 AI 檢測工具當成審查內容真偽或保護智慧財產權的唯一標準。經營者在建立內部 AI 導入規範時,仍應將焦點放在資料品質、著作權風險管理以及實質內容的審核機制,而非單純依賴自動化工具的辨識結果。

背景補充

歐盟推出的《人工智慧法案》是全球首部針對 AI 技術設立的全displayName立法,其中明確要求生成式人工智慧(AI)系統必須提供機器可讀的標記機制,以便外部判斷內容是否由 AI 所產出。在此規範下,科技巨頭紛紛尋求合規方案。

在 OpenAI 之前,人工智慧新創公司 Anthropic 亦曾宣布在旗下大型語言模型(LLM)Claude 中導入文字浮水印,其做法是利用公司內部的秘密金鑰,每隔固定字數依照隱藏模式挑選同義詞,並隨後引發業界對文字可讀性與檢測專屬性的討論。目前 OpenAI 除了在歐盟對 ChatGPT 與 Codex 陸續啟用這項功能外,全球應用程式介面(API)客戶亦可選擇性開啟(預設為關閉),並計劃開放研究機構申請檢測工具,未來更打算將技術原始碼開源,推動全行業的 AI 內容治理標準。

常見問題

什麼是 OpenAI 的 textGrain 文字浮水印技術?

textGrain 是 OpenAI 研發的隱形文字標記機制,透過在 AI 模型生成文本時微幅調整選字機率植入統計訊號,讓專用檢測工具能辨識內容是否由 OpenAI 系統產出。

AI 文字浮水印是否會影響 ChatGPT 的回答品質?

根據 OpenAI 的測試數據,加載文字浮水印的模型輸出在多項基準測試中與未加水印版本並無實質差異,不會對文字可讀性或邏輯表現造成負面影響。

經由改寫或翻譯後的文字還能被 AI 檢測工具識別嗎?

辨識效果會大幅降低。研究顯示,若將文本中 25% 的詞彙更換為同義詞,浮水印的偵測成功率會從原本的 92% 銳減至 17%。