OpenAI textGrain 文字浮水印技術正式發佈:因應歐盟 AI Act 規範全面導入生成內容辨識

BlueSky

AI 摘要

  • OpenAI 推出名為 textGrain 的文字浮水印技術以符合歐盟法規。
  • 技術透過 AI 選字微調建立統計模式,供專屬金鑰辨識來源。
  • 即日起開放 API 用戶啟用,並將陸續導入歐盟地區服務。

為因應歐盟《人工智慧法》(AI Act)針對生成內容的辨識要求,OpenAI 正式發表了全新的 OpenAI textGrain 文字浮水印技術。這項技術透過演算法在文字生成過程中嵌入統計訊號,未來數週內將率先導入歐盟地區的 ChatGPT 與 Codex 服務,即日起亦開放全球 API 用戶針對特定模型啟用。

產品定位與法規背景

歐盟《人工智慧法》第 50 條第 2 款明定,AI 系統供應商所生成的文字、圖片、音訊或影片,必須具備機器可讀標記以利辨識。先前 OpenAI 已在圖像與音訊領域採用 C2PA 及 SynthID 等技術,而 OpenAI textGrain 則是專門為文字生成設計的來源驗證解決方案,旨在解決文字易因修改而遺失浮水印標記的技術難題。

技術原理:統計偏差與金鑰偵測

OpenAI textGrain 並非在文字中塞入肉眼可見或固定的特殊符號,其運作機制與市面常見的推測型 AI 偵測工具有本質上的差異:

  • 選字微調偏差:AI 在生成文字選擇詞彙時,會依演算法加入極細微的機率偏差,讓整段內容自然形成特殊的統計模式。
  • 秘密金鑰驗證:驗證端可藉由對應的秘密金鑰檢查該統計規律,藉此確認文字是否出自 OpenAI 的模型。
  • 兼顧生成品質:在確保文字順暢度與語意不受干擾的前提下,最大化浮水印的偵測準確度。

偵測表現與技術限制

根據官方公布的技術報告,OpenAI textGrain 的辨識能力取決於文字長度與改寫程度。在維持 1% 誤判率的基準下,不同長度與同義詞替換後的偵測表現如下:

評測情境(心理學內容 / 400 Token)改寫或調整比例浮水印偵測成功率
短篇文字(約 200 Token)無改寫(0%)約 80%
中長篇文字(約 400 Token)無改寫(0%)約 95%
同義詞改寫測試(400 Token)替換 10% 詞彙從 92% 降至 66%
深度改寫測試(400 Token)替換 25% 詞彙降至 17%

OpenAI 同時指出,字數過少或用詞選擇受限的內容(如數學推導)較難準確偵測。此外,偵測到浮水印僅代表系統曾參與生成或處理,無法作為判定人類參與比例、所有權或事實真偽的唯一依據。

推出時程與開放方案

在產品發佈時程方面,全球 API 客戶即日起已可針對部分支援的模型自行啟用 OpenAI textGrain 浮水印機制;歐盟地區的 ChatGPT 及 Codex 則會在未來數週內全面套用。考量到漏判與誤判風險,專用的偵測工具目前暫不對公眾開放,僅優先提供研究人員與專業機構申請測試。

Reference Link : ithome.com.tw

Related Articles

Stay Connected

0FansLike
0FollowersFollow
22,800SubscribersSubscribe
spot_img

Latest Articles