
使用 AI 來撰寫文案已經相當普遍,但不同於 AI 圖片、影片會有編碼浮水印來進行內容真偽辨識,文字沒有這方面的機制,不過 Claude AI 的開發公司 Anthropic 正式宣布配合歐盟法規,對 AI 生成的文字加入可供驗證的編碼格式。
根據外媒 Interesting Engineering 的報導,Anthropic 為了配合即將生效的《歐盟人工智慧法案》(EU AI Act)第 50 條「AI 生成內容透明度」的要求,率先在「全球統一」實施對文字加入浮水印編碼, 從 8 月 2 日之後更新的 Claude 模型都會將在產出內容自動套用標籤。
文字浮水印是只存在於程式碼中的標籤資訊,在一般瀏覽時不會顯現,不對觀看造成干擾,但可以透過專門的驗證機制,讀取與辨識文字是否為 AI 產出,平台的開發者便可依此選擇在介面上加註警語,或是供警方、學術機構作為內容可信度的判斷依據。
這套標籤資訊就好比一種專屬於 AI 的紋路,即使經過複製、調整順序、轉換格式,都依然會保留下來,驗證機制都可透過特徵進行比對,照樣可以判斷機械與人工修改的程度,理論上,也能得知是由哪一家 AI 的模型生成。
不過也因為是類似紋路的概念,比對需要一定數量的文字內容,如果被大幅人工修改,將會讓標籤被稀釋,而無法被辨識。
Anthropic 強調,浮水印只能代表「有 AI 高度協助」,不代表通篇都是 AI 瞎掰;相反的,無浮水印也不代表完全沒用 AI,也可能只是作為輔助,被深度改寫。
倘若接下來個家巨頭都套用了文字浮水印的機制,將能夠很大程度改善 AI 資訊在網路上的誤導行為,警示人們做出額外的查證。同時對於許多學術機構和論文撰寫者,也終於有了可靠的檢測方案,不必再強塞無意義敘述和錯字,只為提升審查時人工比例分數。