Skip to article
← 返回情報台

Anthropic 水印計劃顯示監管正進入模型內部

歐洲透明度義務生效後,新 Claude 模型將標記生成文字,並為檔案加入來源資料。

編輯判斷

AI 內容披露正成為基礎設施功能,而非出版者最後補上的標籤。

Anthropic 表示,在歐盟透明度規則生效後推出的模型,將為生成文字加入標記,並在支援的圖像檔案加入來源資料。措施回應《AI 法案》第 50 條,目標是讓合成或經操控內容可以被識別。

真正重要的是架構改變。可見提示在內容被複製後容易消失,檔案 metadata 亦可能在匯出時被移除;模型層水印嘗試把統計訊號留在輸出本身,但其耐用程度、誤判率及第三方能否可靠檢測,仍有待驗證。

對企業而言,披露已不能只當作發佈前的最後一個剔選框。內容系統需要在編輯、翻譯及分發過程保留來源鏈,並說明人工工作何時已實質改變 AI 草稿。監管開始直接塑造生成技術棧。

來源說明

本簡報綜合已報道事實並加入獨立脈絡,不複製來源文章的措辭或結構。