首頁 / 資訊 / Claude 的文字現在帶有只有機器能讀取的隱藏簽名
Anthropic

Claude 的文字現在帶有只有機器能讀取的隱藏簽名

2026年8月12日4 分鐘閱讀
Claude 的文字現在帶有只有機器能讀取的隱藏簽名

新聞摘要

Anthropic 已開始將不可見的浮水印直接嵌入其 Claude 模型產生的文字中,該公司表示,這項措施將讓使用者、平台和研究人員能驗證某段文字是否由 AI 產生。不同於傳統的中繼資料標籤(只要將文字複製到另一個文件就會被剝除),新的浮水印是編織在文字本身之中,意味著它能承受複製貼上操作,而且在許多情況下,即使經過適度編輯仍能留存。

浮水印的運作方式

根據 Anthropic 的說法,該系統透過微妙地影響 Claude 在產生回應時選擇哪些字詞和措辭來運作。這些變化設計成對人類讀者來說難以察覺——它們不會改變輸出的意義、語氣或品質——但它們會形成一種統計模式,之後專用偵測器可以分析這種模式,以判斷文字是否可能源自 Claude。Anthropic 表示,它打算發布技術文件說明偵測過程的運作方式,並提供工具讓第三方、出版商和研究人員檢查某段文字是否帶有 Claude 浮水印。

推出與範圍

浮水印適用於 2026 年 8 月 2 日起發布的所有新版 Claude 模型,Anthropic 已確認這項功能在 Claude 提供的所有地區均啟用,不限於任何單一地區或產品等級。該公司也正在將類似的來源訊號擴展到影像輸出,採用廣泛使用的 C2PA 內容憑證標準,該標準會嵌入可驗證的中繼資料,描述 JPEG 或 PNG 檔案的建立方式。

Anthropic 為何這麼做

這個時機點與歐盟即將生效的新透明度義務相符。Anthropic 是歐盟 AI 法案中《AI 生成內容透明度實務守則》的簽署方,該守則屬於第 50(2) 條的一部分,要求生成式 AI 系統的提供者標記其輸出,以便能被識別為機器製作。雖然這項要求源自歐盟法規,但 Anthropic 表示浮水印將全球適用,而非僅限於歐洲使用者,這反映了該公司在其全球所有使用者群中推動一致來源標準的更大努力。

Anthropic 已承認的限制

該公司坦承浮水印並非萬無一失的偵測機制。大量改寫、大幅重寫或將文字透過另一個編輯工具處理,都可能稀釋或完全抹除統計訊號。非常短的段落所含文字太少,無法可靠地嵌入或偵測模式。Anthropic 也警告,即使偵測到浮水印,它只表示 Claude 在某個時間點參與了文字的產生——它無法確認誰發布了內容、是否經過事實查核,或之後被人類編輯修改了多少。

對讀者、教育者和出版商的意義

對於正在應對 AI 生成內容擴散的媒體機構、學術機構和線上平台,業界支持的偵測訊號提供了一個新的(即使不完美)驗證層。評估學生作業的教育者、審查自由投稿的編輯,以及審核使用者生成內容的平台,在評估文字是否由 AI 輔助時,都可能將即將推出的偵測工具作為多個參考依據之一。Anthropic 將這項計畫定位為更廣泛的產業趨勢的一部分,即為生成式 AI 建立透明度基礎設施,並將其與科技業界已針對 AI 生成影像和影片進行的類似來源工作並列。

AnthropicAI 浮水印