台灣即時新聞 · 快速準確全面
快訊

ChatGPT 文字浮水印上路 歐盟先行台灣暫未跟進

ChatGPT 文字浮水印上路 歐盟先行台灣暫未跟進 cover

OpenAI 日前宣布,將為 ChatGPT 與 Codex 產生的文字加入一種「看不見、但機器可讀取」的隱形浮水印,並在未來幾週內於歐盟地區率先實施,以符合歐盟《人工智慧法案》對 AI 生成內容辨識的要求。現階段這項功能不會設為全球預設,台灣使用者暫時不受影響。

這項技術被 OpenAI 命名為 textGrain。與一般想像不同,textGrain 並非在文字裡藏入固定標記,而是在 AI 選字時加入極細微的偏差,讓整篇文字逐漸形成肉眼看不出的統計模式,再利用對應的秘密金鑰檢查是否帶有 OpenAI 的浮水印。

法規背景方面,歐盟《人工智慧法案》第 50 條第 2 款要求,生成文字、圖片、音訊或影片的 AI 供應商,必須讓這些內容帶有機器可讀標記,並能被辨識為 AI 生成或修改,這項規定已於今年 8 月 2 日生效。OpenAI 先前已在部分圖片與音訊中加入來源驗證機制;相較於圖片與音訊,文字更容易因改寫、刪減或翻譯而破壞原有標記,因此文字浮水印長期以來較難穩定實作。

OpenAI 同步發布了 textGrain 的技術報告,說明其生成與偵測機制,以及如何在提高浮水印辨識度的同時,降低對文字生成結果的影響。目前市面上已有不少 AI 文字偵測工具,多半是根據用詞、句型與文字可預測性等特徵,推測內容是否由 AI 生成,並非偵測模型預先埋入的標記,兩者原理並不相同。

不過 OpenAI 也坦言,文字浮水印技術仍處於初期階段,可能出現「誤判」或「漏判」,也就是其實沒有浮水印卻被判定為有,或明明存在浮水印卻沒有被偵測出來。文字愈短,或內容本身可變化的用字愈少,就愈難偵測,例如數學類型內容,由於答案與用詞變化空間較小,辨識效果就會比較差。

在把誤判率控制在 1% 的情況下,約 200 個 token 的心理學內容偵測率約 80%,增加至 400 個 token 後可提高到約 95%。而文字一旦經過改寫,浮水印訊號也會快速減弱:以 400 個 token 的文章為例,若將 10% 詞彙換成同義詞,偵測率會從約 92% 降至 66%;替換 25% 後,更只剩 17%。

由於偵測仍可能出現漏判與誤判,OpenAI 暫時不打算公開提供 textGrain 偵測器,初期只開放研究人員及專業機構申請使用,一般使用者無法直接取得。

OpenAI 也特別提醒,偵測到浮水印只能表示其系統可能曾參與生成或處理文字,不能據此判斷人類參與程度、內容所有權、使用者身分或文字真偽;反之,未偵測到浮水印,也不能證明內容一定由人類撰寫。

在全球政策方面,API 部分從即日起開放全球客戶針對部分模型自行選擇是否啟用文字浮水印,預設仍為關閉。在歐盟法規推動下,AI 內容透明化逐漸成為業界共識,其他平台也已先後導入類似的文字浮水印機制。

接下來幾週歐盟正式實施後的實際成效、偵測器何時能擴大提供,以及台灣等其他地區何時可能跟進,將是後續觀察重點。對教育與出版等高度依賴文字原創性的領域而言,如何認定 AI 生成內容,仍有待更完整的配套討論。