Claude生成圖文 嵌入隱形水印

Claude生成圖文 嵌入隱形水印 遵從歐盟AI新法案 Anthropic推識別措施 以往利用人工智能(AI)代筆,或許難以辨認,日後卻可能變得「證據確鑿」,一舉一動無所遁形。為遵守歐盟AI透明度的規定,美國AI初創Anthropic開始在Claude輸出的文字及圖片上,添加數碼簽章的來源元資料(Metadata)。生成的內容將帶有嵌入式水印,這些隱藏圖案用肉眼無法察覺,但機器可以檢測得到,複製貼上仍然有效,方便用戶及網上平台,識別內容是否由Claude模型生成。 網民憂用AI輔助也遭標籤 新標記政策宣布後,隨即在社交媒體上引發熱議,有網民認為這是「開創極為惡劣先例」,部分人擔心將來使用Claude協助改寫、潤飾或翻譯個人原創文章時,產出內容也會帶有水印,恐導致誤判。 歐盟2024年通過的《人工智能法案》,被視為全球首項全面的AI規範法律。於8月2日生效的第50條規定,新增AI標籤及透明度的義務。不遵守規定的科企可處以最高1500萬歐羅(約1.35億港元),或全球年度總營業額3%的罰款,以較高者為準。為了讓用戶知悉資料性質,企業應在AI生成的內容,以水印等方式清楚標示。 截圖轉換格式或令標記消失 Anthropic新標記政策全球通用,不只限於歐洲,涵蓋Claude所有服務,包括Claude應用程式、應用程式(API)介面平台、Claude Code、Claude Cowork及Claude Tag,以及透過亞馬遜網絡服務(AWS)、Google Cloud,以及Microsoft Foundry存取的Claude模型。 Claude使用兩種互補技術,標記AI模型生成及處理的內容。首先是嵌入文本的水印,經過編輯後仍可能存在;對於PNG、JPG、SVG等圖像文件,Anthropic使用「內容溯源和真實性聯盟」(C2PA)開放標準。 Anthropic明確表示,水印僅屬訊號而非證據,只能證明文本可能經過Claude編輯,無法證明文本如何產生。普通的校對、翻譯或重新排版,一般不會移除標記,但格式轉換、重新儲存、熒幕截圖等方式可能令元資料消失。大規模的編輯、翻譯,或者使用短段落、舊模型,亦可能導致Claude作品不被發現。 AI寫作包含結構、風格及語義模式,可以被訓練有素的人士,或先進的檢測軟件識別出來。美企Pangram Labs今年7月,推出AI文字偵測模型Pangram 4,其誤報率僅為0.0041%,即每2.4萬份文件僅一個誤報,聲稱檢測準確率99.98%。 不過,坊間各界亦費盡心機,破解AI系統的檢測。以水印去除器為例,聲稱可以免費去除Claude、ChatGPT、Gemini等AI系統的水印,消除隱藏的零寬度字元、不可見空格,以及其他Unicode標記。 OpenAI開發識別技術進展慢 目前為止,Anthropic尚未推出官方偵測工具,但已表示會努力使用戶和第三方能夠偵測水印,又預告日後的技術文件,將會詳細介紹檢測機制。學校、僱主及內容平台,日後可能將偵測結果,視為AI代筆的證據。計劃在社交平台X及Reddit遭到強烈反對,有人認為是「開創極為惡劣先例」,也有用戶宣布「AI寫作無法被證實的時代」結束。 Anthropic並非孤軍奮戰,例如谷歌DeepMind已開發出SynthID,用於標記AI生成的文字、影像及音訊;OpenAI也討論過水印技術,但其部署進展較緩慢。網上訂閱平台Substack推出AI掃描器,讓讀者估算文章及評論中,人工撰寫及AI生成內容的比例。短片分享平台YouTube也採取相應措施,上月更新其「不真實內容」政策,旨在打擊平台上泛濫的AI垃圾內容。 13 Aug 2026 信報

留言

這個網誌中的熱門文章

寫提詞6招 AI回覆更高質

戒網癮App 夠鐘即封鎖手機