規避AI浮水印新技術問世 恐掀內容真偽辨識軍備賽

商傳媒/[email protected] (商傳媒 SUN MEDIA)
31 分鐘前
圖/本報資料庫

商傳媒|責任編輯/綜合外電報導

隨著人工智慧(AI)生成內容日益普及,如何有效辨識其真偽成為一大挑戰。為了解決這項問題,包括谷歌(Google)在內的科技巨頭已開發 AI 浮水印(Watermark)技術,旨在於生成的內容中嵌入肉眼或人類感官難以察覺的數位標記。然而,一項最新研究提出,有新方法可能規避這些先進的浮水印系統,恐將開啟內容真偽辨識的全新「軍備競賽」。

這項新方法特別針對類似谷歌 SynthID 的 AI 浮水印技術。例如谷歌開發的 SynthID,便是一種用於影像的 AI 浮水印工具,它透過在內容中嵌入不可察覺的訊號,使其能夠被識別為 AI 所創造。

根據報導,新提出的規避技術利用偽隨機生成器,旨在破壞 AI 浮水印賴以識別的統計偏差。這種技術的核心概念,是透過「直接在提示詞中讓 AI 浮水印脫離」(dribbling the AI watermark directly in-prompt),利用大型語言模型(LLM)固有的靈活性及生成能力,來模糊或移除構成 AI 浮水印的微妙統計模式。這意味著,即使浮水印已嵌入內容,攻擊者也能在不大幅改變人類可感知內容的情況下,戰略性地引入偽隨機元素或修改輸出,進而干擾這些統計偏差。

這項發展凸顯出AI生成內容識別的持續挑戰,以及浮水印與反規避技術之間可能存在的「軍備競賽」。如果這類規避方法變得普遍且有效,那麼要明確識別 AI 生成的文字或媒體內容將大幅受損。這也代表著像谷歌和 OpenAI 等積極開發浮水印技術的公司,將需要不斷創新,才能領先這些規避技術。對 AI 工具的使用者而言,這也更強化了對內容進行批判性評估的需求,無論內容是否帶有明確的 AI 浮水印,都應審慎判斷。