Anthropic全面導入「隱形浮水印」!複製文字、生成圖片都能追溯來源

Anthropic全面導入「隱形浮水印」!複製文字、生成圖片都能追溯來源。(圖:Shutterstock)
Anthropic全面導入「隱形浮水印」!複製文字、生成圖片都能追溯來源。(圖:Shutterstock)

人工智慧(AI)大廠 Anthropic 近日宣布,將為旗下 Claude 系列模型全面導入「機器可讀」內容標記機制,未來由 Claude 生成的文字內容都將被植入肉眼無法察覺的隱形浮水印,圖片等檔案則會附上經數位簽章的來源資訊。

根據 Anthropic 週二(11 日)發布的官方說明,這套機制與市面上多數僅依附在檔案「元資料」(metadata)的標記方式不同。

Claude 的文字浮水印是直接編織進內容本身。也就是說,即使使用者將 AI 生成的文字複製到其他平台、甚至進行部分改寫,浮水印仍有機會留存,使追蹤 AI 生成內容的能力較過往方案大幅提升。

至於圖片檔案,Anthropic 則採用另一套作法:當 Claude 產出如 SVG、PNG、JPG 等格式的檔案時,系統會自動附加經數位簽章的溯源資訊,並遵循目前業界廣泛採用的內容溯源與真實性聯盟(C2PA)公開標準。

只要檔案帶有這項簽章標籤,就能作為該內容曾經過 Claude 處理的佐證,同時也有助於判斷檔案是否遭到後續竄改。

促使 Anthropic 此時祭出這項措施的關鍵背景,是該公司已簽署歐盟《人工智慧法案》第 50 條第 2 項下的《AI 生成內容透明度行為準則》。

依規定,凡自 2026 年 8 月 2 日起於歐盟境內推出的新版 Claude 模型,都必須從上市當天起就具備內容標記能力。

值得注意的是,Anthropic 強調這項標記機制並非僅為滿足歐盟法規而設的區域限定措施,而是將全面適用於 Claude 旗下所有產品線與合作雲端平台,範圍涵蓋全球市場。

目前確定納入的服務包括 Claude Platform(API)、Claude 應用程式本身、Claude Code、Claude Cowork,以及 Claude Tag,同時也適用於透過 AWS、Google Cloud 與 Microsoft Foundry 等雲端夥伴管道使用 Claude 的用戶。

至於在此規範上路前已經發布的既有模型,由於歐盟法規設有過渡緩衝期,Anthropic 表示正著手為這些「舊款」模型加裝標記功能,細節將於後續陸續公布。

在推出新機制的同時,Anthropic 也罕見地在官方文件中詳細列舉了這套系統的侷限,提醒外界不宜將其視為絕對可靠的鑑別工具。

該公司指出,即便偵測到 Claude 的標記,也只能說明內容「有可能」經過 Claude 處理,無法百分之百還原完整的內容來源。

舉例而言,許多使用者其實是拿既有文件請 Claude 協助校對、翻譯、摘要或格式轉換,這類輸出雖然帶有 Claude 的標記,但文字背後的原始構想、論述甚至數據,其實另有出處;內容也可能在 Claude 處理完畢後,又經過使用者進一步刪修、節錄或與其他素材合併。

反過來說,「沒有偵測到標記」同樣不能作為內容並非 AI 生成的證明。

Anthropic 列出多種可能導致標記缺失的情境,包括:內容是由標記功能上線前的舊版模型所產出;文字經過大幅改寫、翻譯或與其他內容混雜;段落篇幅過短,不足以承載可辨識的訊號;檔案在轉檔、另存新檔或截圖過程中遺失了原始元資料;又或者內容本身來自尚未支援該類標記技術的平台或檔案格式。

針對將 Claude 技術整合進自家產品的企業與開發者,Anthropic 在說明中特別提醒,各家業者仍應依據《人工智慧法案》第 50 條的規定,自行評估相關透明度義務對其產品與服務所帶來的具體要求。

換言之,即便 Anthropic 已在技術層面提供標記工具,下游開發者的合規責任並不會因此自動轉移或免除,仍須主動釐清自身在法規框架下應承擔的義務範圍。


延伸閱讀

相關貼文

prev icon
next icon