Anthropic 在 2026 年 8 月中旬正式對外揭示其為 Claude 模型 部署的全面文字水印方案——內部代號「Scarlet Letter」。這項機制是為了回應 歐盟 AI 法案(EU AI Act) 對 AI 生成內容標記的強制要求,然而其實施範圍遠超法規最低門檻,引發了關於水印技術實用性與潛在誤導風險的深度討論。
水印技術核心:從生成到處理
不同於市面上多數 AI 水印方案僅標記 完全由 AI 生成的內容,Anthropic 採取了一種更激進的「地毯式轟炸」策略:
- 所有經過 Claude 處理的內容 都會被嵌入不可見的水印,無論是全文生成、摘要、翻譯、還是一般校對
- 即使是 只修正了一個逗號 的人類原創文稿,Claude 也會在其輸出中留下水印
- 水印透過 在模型詞彙選擇上施加微妙偏差 來實現,形成一個僅能在全文層次上被專用檢測工具識別的模式
- 非文字內容則採用 C2PA 元數據標準 記錄來源
歐盟 AI 法案的推動力
根據歐盟 AI 法案,所有在 2026 年 8 月 2 日後發布的 AI 模型都必須對其生成或操縱的音訊、影像、文字和影片輸出進行水印標記。現有模型則享有至 2026 年 12 月 的寬限期。Anthropic 表示,所有新模型——不限於歐盟市場——都將從發布首日起執行水印。
值得注意的是,法案明確將 AI 僅執行「輔助編輯功能」(如文法校正)的情況排除在標記義務之外。但 Anthropic 坦言:「人們經常使用 Claude 進行校對、翻譯、摘要或檔案轉換。即使用戶的原創想法、文字或資料來自其他來源,輸出仍可能帶有 Claude 標記。」
水印的結構性弱點
Ars Technica 的深入分析指出了這套方案的多項根本性問題:
水印可被輕易移除
- 若將水印文字貼入其他聊天機器人進行編輯,水印可能被摧毀
- 影像和影片內容可以透過截圖或元數據編輯工具輕鬆移除
- 一旦 Anthropic 公開檢測工具,建立水印移除系統將更為簡單
檢測結果的非確定性
Anthropic 承認:「檢測到的標記提供內容可能經 Claude 處理的信號,但並非完全確定。」水印甚至可能出現在「未經 Claude 生成的內容」上,而「缺乏檢測到的標記並不等於內容非 AI 生成」。
潛在的社會誤解
水印無法區分「輕度編輯」與「完整生成」,可能導致教師、雇主等非技術用戶將所有帶有水印的內容等同於 AI 產出。這在學術誠信與職場場景中可能造成嚴重誤判。
業界對比與更廣義的監管挑戰
| 面向 | Anthropic 水印方案 | 歐盟 AI 法案要求 |
|---|---|---|
| 標記範圍 | 所有 Claude 處理的內容 | 僅 AI 完全生成或實質改變的內容 |
| 編輯豁免 | 無豁免(文法校正亦標記) | 輔助編輯功能明確豁免 |
| 地理範圍 | 全球 | 歐盟境內 |
| 公開檢測工具 | 計畫中,尚未發布 | 法規要求提供技術支援 |
| 違規代價 | — | 最高 1,500 萬歐元或年收入 3% |
Anthropic 表示:「我們正在為 Claude 的輸出添加標記以遵守歐盟 AI 法案,其他實驗室也在採取類似措施。」公司計劃未來發布一套文字檢測 API,讓用戶自行鑑別內容是否經過 Claude 處理。
展望:水印技術的未來路徑
此案例凸顯了 AI 監管的深層矛盾——技術方案與政策意圖之間的錯位。法規要求「可靠且穩健」的標記技術,但目前的 AI 水印在面對截圖、重新排版、跨模型編輯等常見操作時幾乎完全失效。當標記的覆蓋範圍遠超法律要求、同時檢測結果又充滿不確定性時,這套系統能否真正實現「維護資訊生態系統誠信」的立法初衷,仍是懸而未決的問題。
本文信息來源:Ars Technica(Ashley Belanger 報導)、Anthropic 官方公告,2026 年 8 月 13-22 日。