
AI 摘要
- OpenAI 推出名為 textGrain 的文字浮水印技術以符合歐盟法規。
- 技術透過 AI 選字微調建立統計模式,供專屬金鑰辨識來源。
- 即日起開放 API 用戶啟用,並將陸續導入歐盟地區服務。
為因應歐盟《人工智慧法》(AI Act)針對生成內容的辨識要求,OpenAI 正式發表了全新的 OpenAI textGrain 文字浮水印技術。這項技術透過演算法在文字生成過程中嵌入統計訊號,未來數週內將率先導入歐盟地區的 ChatGPT 與 Codex 服務,即日起亦開放全球 API 用戶針對特定模型啟用。
產品定位與法規背景
歐盟《人工智慧法》第 50 條第 2 款明定,AI 系統供應商所生成的文字、圖片、音訊或影片,必須具備機器可讀標記以利辨識。先前 OpenAI 已在圖像與音訊領域採用 C2PA 及 SynthID 等技術,而 OpenAI textGrain 則是專門為文字生成設計的來源驗證解決方案,旨在解決文字易因修改而遺失浮水印標記的技術難題。
技術原理:統計偏差與金鑰偵測
OpenAI textGrain 並非在文字中塞入肉眼可見或固定的特殊符號,其運作機制與市面常見的推測型 AI 偵測工具有本質上的差異:
- 選字微調偏差:AI 在生成文字選擇詞彙時,會依演算法加入極細微的機率偏差,讓整段內容自然形成特殊的統計模式。
- 秘密金鑰驗證:驗證端可藉由對應的秘密金鑰檢查該統計規律,藉此確認文字是否出自 OpenAI 的模型。
- 兼顧生成品質:在確保文字順暢度與語意不受干擾的前提下,最大化浮水印的偵測準確度。
偵測表現與技術限制
根據官方公布的技術報告,OpenAI textGrain 的辨識能力取決於文字長度與改寫程度。在維持 1% 誤判率的基準下,不同長度與同義詞替換後的偵測表現如下:
| 評測情境(心理學內容 / 400 Token) | 改寫或調整比例 | 浮水印偵測成功率 |
|---|---|---|
| 短篇文字(約 200 Token) | 無改寫(0%) | 約 80% |
| 中長篇文字(約 400 Token) | 無改寫(0%) | 約 95% |
| 同義詞改寫測試(400 Token) | 替換 10% 詞彙 | 從 92% 降至 66% |
| 深度改寫測試(400 Token) | 替換 25% 詞彙 | 降至 17% |
OpenAI 同時指出,字數過少或用詞選擇受限的內容(如數學推導)較難準確偵測。此外,偵測到浮水印僅代表系統曾參與生成或處理,無法作為判定人類參與比例、所有權或事實真偽的唯一依據。
推出時程與開放方案
在產品發佈時程方面,全球 API 客戶即日起已可針對部分支援的模型自行啟用 OpenAI textGrain 浮水印機制;歐盟地區的 ChatGPT 及 Codex 則會在未來數週內全面套用。考量到漏判與誤判風險,專用的偵測工具目前暫不對公眾開放,僅優先提供研究人員與專業機構申請測試。
Reference Link : ithome.com.tw




