人工智慧研發巨頭OpenAI近日宣布,將陸續在歐盟地區自動為ChatGPT產生的文字加入數位浮水印,以迎合2024年8月正式生效、並於近年陸續實施的《歐盟人工智慧法案》(EU AI Act)規範。該法案強制要求AI產生的內容必須能被明確標記與偵測。不過OpenAI指出,這項新功能在歐盟以外的地區(包含台灣在內),目前預設仍會保持關閉狀態,暫時不影響台灣一般用戶的日常使用。
 
這項名為「textGrain」的專利技術,是在不影響文字輸出品質的前提下,於字詞選擇中加入人類讀者難以察覺的特定模式,持有密鑰的機構則可透過專用偵測器識別。OpenAI表示,未來幾週內該功能將逐步推向歐盟區的ChatGPT與Codex應用程式用戶,而API部分則維持預設關閉,可由開發者自由選用。

修改兩成字詞偵測率剩四分之一

雖然OpenAI強調這套專利技術在最佳狀態下,能達到高達92%的成功偵測率。然而,根據官方發表的技術論文測試顯示,文字浮水印技術仍存在不小的漏洞。只要使用者將AI生成的內容修改僅10%的文字,偵測成功率就會急遽下滑近30%;若動手修改達20%的文字,偵測成功率更會暴跌近75%,幾乎等同於失效。
 
此外,測試結果也證實,篇幅較短的文句或是經過翻譯的文字,其浮水印的偵測效果都會大打折扣。目前科技業界在AI防偽技術上仍缺乏完全有效且可靠的防護網,即使市面上已存在如SynthID與C2PA等防偽標準,對於具備基本技術知識的網路用戶而言,依然相當容易遭到刻意規避。

競品採全球強制 台灣未來動向受矚

在科技巨頭的防偽布局方面,各家策略明顯大不相同。OpenAI的強勁競爭對手Anthropic,先前就已針對旗下模型所產生的文字全面導入數位浮水印,並採取全球用戶一律強制啟用的高標準策略。反觀OpenAI則採取相對保守的法規導向作為,目前僅針對有法律強制約束力的歐盟地區預設開啟。
 
市場分析指出,雖然台灣目前不在OpenAI自動啟用的範圍內,但隨著台灣《人工智慧基本法》草案持續推進,未來國內法規若逐步向歐盟防偽規範看齊,台灣用戶與在地企業未來也可能面臨AI生成內容必須強制標記的變革。在兼顧用戶隱私與防範AI濫用的權衡下,這項科技巨頭之間的防偽攻防戰,預期將隨著各國法規收緊而愈演愈烈。