OpenAI 在歐盟替 ChatGPT 文字加上隱形浮水印:textGrain 怎麼運作、偵測率多少,台灣學生與企業該知道的事

OpenAI 在歐盟替 ChatGPT 文字加上隱形浮水印:textGrain 怎麼運作、偵測率多少,台灣學生與企業該知道的事

歐盟使用者接下來從 ChatGPT 複製出去的每一段文字,都會帶著一組肉眼看不見的統計指紋。但換掉四分之一的字,指紋就幾乎認不出來了。

OpenAI 在歐盟替 ChatGPT 文字加上隱形浮水印:textGrain 怎麼運作、偵測率多少,台灣學生與企業該知道的事

阿姆斯特丹一間行銷公司的文案,每天早上習慣先讓 ChatGPT 擬好三版產品新聞稿,再挑一版改改送出。從這個月開始,她貼進客戶信箱的那幾段文字,可能都夾帶了一組她看不到、也刪不掉的訊號。文字本身一個字都沒變多,標點也沒怪,只是用字的機率被輕輕推了幾百次。

這是 OpenAI 在 10 月 5 日公布的新做法。對身在台灣的我們,影響沒有歐洲那麼直接,但它很可能改寫接下來幾年「這段文字是不是 AI 寫的」這個爭論的遊戲規則。

事件背景

推手是歐盟《人工智慧法》第 50 條。這條透明度義務要求生成式 AI 的提供者,把合成內容標記成機器可讀、可被偵測的格式,條文自今年 8 月 2 日起適用,對已上市系統另有過渡安排。圖片、聲音早有 C2PA 一類的來源標記可用,文字卻一直是難題:純文字沒有檔頭可以塞資料,複製貼上就什麼都不剩。

各家的進度並不一致。Google 從 2024 年起就用 SynthID 替 Gemini 的文字加浮水印;Anthropic 在今年 8 月宣布替 Claude 產出的文字加上隱形浮水印。OpenAI 其實很早就有相關技術,過去外媒報導它遲遲沒上線,原因包括誤判與競爭上的顧慮。這次終於端出來,而且附上與賓州大學、耶魯大學研究者合寫的技術報告。

本次重點

  • 技術名稱 textGrain:不加隱藏字元、不插零寬空白,而是用一把祕密金鑰,在模型挑下一個字時做出幾百次微小偏移,留下讀者看不出、偵測器抓得到的統計模式。複製貼上會跟著走。
  • 範圍:歐盟地區所有方案的 ChatGPT 與 Codex 使用者,未來幾週陸續自動套用;全球 API 客戶自 10 月 5 日起可在專案中自行開啟,預設關閉。OpenAI 明講這次不會在全球預設啟用。
  • 偵測率:在 1% 誤判率下,200 個 token 的段落約八成能被抓到,400 個 token 約 95%。
  • 改寫後的衰減:替換一成的字為同義詞,偵測率從約 92% 掉到 66%;替換兩成五,只剩 17%。數學解答、很短的段落與翻譯後的文字也比較難測。
  • 偵測器不公開:初期只開放給通過審核的研究者與專業機構,逐案核准。
  • 官方自己畫的界線:浮水印無法辨識是誰用的、無法衡量人類貢獻多少、不能證明內容正確或歸屬;沒有偵測到浮水印,也不代表是人寫的。

市場影響分析

台灣使用者

先說最多人關心的:人在台灣用 ChatGPT,目前不在自動套用範圍。但別把這當成安全感。

我比較在意的是教育現場。台灣不少大學老師已經在用 GPTZero 這類統計型偵測工具抓報告,那類工具靠的是「讀起來像不像 AI」,誤判學生的案例並不少見。浮水印的邏輯完全不同,它找的是事先埋好的訊號,理論上更可靠,可是偵測器目前握在 OpenAI 和少數機構手上,學校拿不到。另外,官方數據沒有依語言拆開,中文的偵測率是多少,目前沒有公開資料。翻譯會削弱訊號這點,對常在中英文之間來回的台灣學生尤其微妙。

我給學生的建議沒變:AI 可以用,但寫清楚怎麼用,把草稿與修改紀錄留著。真的被質疑時,過程紀錄比任何偵測報告都有說服力。延伸閱讀可以看我們整理的 用 AI 寫報告會被抓到嗎。

企業應用

有歐洲客戶的台灣公司要多想一步。假設你的歐洲分公司用 ChatGPT 產出產品說明、客服回信,這些內容從現在起會帶著浮水印。它本身不違法,也不影響閱讀,但若合約裡有「內容須為原創撰寫」之類的條款,法務最好先確認雙方對 AI 輔助的認定一致。

反過來看,若你是在歐盟提供生成式 AI 服務的業者,第 50 條的義務會落在你身上,不是只有 OpenAI 要煩惱。我們先前整理過的 歐盟 AI 法簡化方案與執法時程 可以搭配參考,實際義務請諮詢熟悉歐盟法規的律師。

開發者

API 那個開關才是本次對台灣開發者最實際的部分。如果你的服務有歐盟使用者,自己開啟浮水印等於把一部分合規工作外包給上游模型;如果服務只做台灣市場,維持預設關閉也合理。要注意的是,你的產品若會對輸出做大量後處理,例如摘要再改寫、翻譯、套模板,訊號會被稀釋,別把它當成萬無一失的來源證明。

用 Codex 寫程式的團隊也在歐盟範圍內。程式碼的用字彈性比散文小,浮水印在程式碼上的表現,官方沒有特別說明,值得後續觀察。

未來發展趨勢

三家大廠現在都替文字上了浮水印,各用各的方法、各握各的偵測器。接下來的問題很實際:一份報告到底該拿去哪一家驗?我認為下一步會是共通偵測介面或第三方驗證服務,歐盟的透明度行為準則也可能往這個方向推。

另一個趨勢是「去浮水印」工具的出現。Anthropic 宣布浮水印後,市面上很快就有人做出移除工具。OpenAI 自己公布的數據也顯示,換掉四分之一的字訊號就快消失。浮水印擋得住懶得改的人,擋不住有心的人,這點大家心裡要有數。

台灣這邊,人工智慧基本法相關的風險框架仍在建構,目前沒有類似第 50 條的文字標記義務。歐盟的做法會不會被參考,值得持續追蹤。

TheAI學院 總結與評語

浮水印回答的是「這段文字有沒有經過某個模型」,不是「這個人有沒有認真」。

我覺得 OpenAI 這次最誠實的地方,是把限制寫在明處:可被改寫削弱、偵測器不公開、沒有浮水印不等於人寫的。這些話聽起來像免責,其實是在提醒所有想拿它當判決書的人別太激動。對台灣讀者來說,眼前最該做的是三件事:學生留好寫作過程、跨境企業檢查合約裡的原創條款、開發者依市場決定 API 開關。至於「AI 文字偵測」這件事,大概還會吵很久。

資料來源

本文依公開資訊整理,套用範圍、偵測數據與開放時程以 OpenAI 官方公告為準;涉及歐盟法規義務部分僅供參考,不構成法律意見。

常見問題

OpenAI 的文字浮水印會套用在台灣的 ChatGPT 嗎?

依 OpenAI 10 月 5 日公布的內容,自動套用的範圍是歐盟地區所有方案的 ChatGPT 與 Codex 使用者,未來幾週陸續上線,官方表示這次不會在全球預設啟用。台灣使用者目前不在自動範圍內,但全球 API 開發者可以自行在專案中開啟。

textGrain 浮水印是在文字裡藏了隱形字元嗎?

不是。textGrain 不加入隱藏字元、零寬空白或特殊標點,而是用祕密金鑰在模型挑選下一個字時做出許多微小偏移,形成肉眼看不出、偵測器才抓得到的統計模式,因此複製貼上後訊號仍會保留。

把 ChatGPT 的文字改寫後,還偵測得到嗎?

OpenAI 公布的數據顯示,在 1% 誤判率下,400 個 token 的段落約 95% 能被偵測;把一成的字換成同義詞後降到約 66%,換掉兩成五則只剩 17%。很短的段落、數學解答與翻譯過的文字也較難偵測。

老師或公司可以用 OpenAI 的偵測器檢查文章嗎?

目前不行。OpenAI 表示偵測器初期只開放給通過審核的研究者與專業機構,逐案核准。官方也強調,沒有偵測到浮水印並不代表文字是人寫的,浮水印也無法衡量人類貢獻或確認內容歸屬。

資料來源:TheAI學院編輯團隊原創