
Anthropic 最近發表技術說明,確認 8 月 2 日之後推出的所有 Claude 模型都會在輸出文字中植入統計式水印,同時為 .png、.jpg、.svg 等生成檔案附上 C2PA 內容憑證,措施在模型層面生效,覆蓋 Claude Platform API、Claude Code、Claude Cowork 以至經 AWS、Google Cloud、Microsoft Foundry 存取的所有渠道,用戶與企業客戶都無法關閉。
公司把這次改動定性為履行歐盟《人工智能法案》(EU AI Act)第 50 條的透明度義務,技術上沿用 Google DeepMind 的 SynthID-Text 方案,透過改變模型挑選字詞時的隨機來源留下可驗證模式。消息公布後部分付費訂戶以取消訂閱表達不滿,而 OpenAI、Google、Meta、Microsoft、Mistral 等同樣簽署歐盟行為守則的廠商也各自推進相近部署,令生成式 AI 產業同步踏入內容溯源的新階段。
監管死線迫使全球模型同步加暗記
歐盟《人工智能法案》第 50 條由 8 月 2 日起正式適用,要求生成式 AI 供應商為合成內容加上機器可讀標記,並且讓外部系統有能力偵測,歐洲 AI 辦公室在 7 月定稿的《AI 生成內容透明度行為守則》吸納約 190 個簽署方,Anthropic 與其餘主要模型開發商全部在列。
守則同時訂下 2027 年 2 月 2 日的互通性期限,而 8 月 2 日之前已經上市的生成式系統則獲得寬限,需要在 2026 年 12 月 2 日之前完成標記工作。違規罰則相當可觀,最高可達 1,500 萬歐元(約港幣 1.27 億元)或全球年度營業額 3%,兩者取其高。Anthropic 坦言暫時沒有可靠方法按地區劃分適用範圍,因此選擇全球一次過開啟,也解釋了為何香港與亞洲用戶同樣受影響。
水印改動的是隨機來源而非字詞本身
大型語言模型逐字生成內容,每一步都在一堆候選字詞之中挑選最合理的一個,Anthropic 以「今日天氣寒冷而且⋯⋯」為例,模型幾乎不會接上「甜膩」,卻很可能接上「陰沉」或「灰暗」,而兩者對句子意思的影響微乎其微。水印技術正好利用這類低風險的選擇,把原本由普通隨機數決定的結果,改為由一條密鑰配合前文共同決定。文字表面完全沒有增減,也沒有隱藏字元,讀者無從察覺,但持有密鑰的一方可以檢查整段文字的用字序列,計算 Claude 參與撰寫的機率。
這種設計亦決定了水印的能力邊界,事實密集的段落可供調整的空間有限,因為「Isaac Newton 最著名的著作是 Principia」後面只有一個正確答案,水印無從着手;程式碼同樣受制於精確性要求,只有註解一類自由度較高的位置才承載得到訊號。Anthropic 表示內部測試看不出水印影響內容質素、創意或可讀性,而 SynthID-Text 論文所載的對照研究亦顯示人類評分者分辨不出兩者差異。水印不含任何個人資料,無法追溯到特定用戶、機構或對話紀錄,運算成本亦沒有上升,因為整個過程不需要額外 token。
用戶反彈聚焦於無法退出與職場風險
社交平台上的批評大多不在技術本身,而在於選擇權的消失,有訂戶把水印形容為現代版的紅字烙印,擔心經 Claude 起草或改寫的文件在轉載、重新編排之後仍然驗得出 AI 痕跡,因而在職場或校園惹來麻煩。Anthropic 的回應相當直接,指出水印只能判斷 Claude 曾經參與處理,無法區分「Claude 撰寫」與「Claude 大幅編輯」,更不能證明某段文字出自人手。
校對與輕度潤飾幾乎留不下訊號,因為絕大部分字詞屬於原作者;相反翻譯工作由 Claude 逐字選詞,水印會完整保留。至於刻意規避公司承認輕度改寫未必能夠清除訊號,全面重寫則可以做到,只是文字到那個地步已經很難再稱為 AI 生成內容。
企業要重新設計 AI 使用政策而非停用工具
對商業機構而言真正的變數在於可驗證性首次成為外部事實,以往企業依靠內部承諾與抽查管理 AI 使用,往後客戶、監管機構、投標對手甚至傳媒都有機會透過偵測工具反向查證,因此政策必須由「容許或禁止」轉向「披露與紀錄」。Anthropic 已預告將推出文字水印偵測 API,配合任何支援 C2PA 的工具讀取檔案憑證,企業應該及早在合約、投標文件與對外刊物的審批流程加入來源標示欄位,說明哪些部分由 AI 起草、由誰覆核。
值得注意的是透過 API 自行建構產品的公司在法律上往往同時屬於供應者與部署者,合規責任不會因為採用第三方模型而自動轉移,內容行銷、法律、金融與教育等高敏感行業更需要盡快盤點供應鏈,確認外判文案與顧問交付物的處理方式。企業也不必過度恐慌,因為水印證明的是流程而非過失,只要披露機制健全,AI 參與本身並不構成問題。相反隱瞞而被驗出的組織,聲譽損失遠高於一開始就坦白說明。
溯源基建將成為內容產業的預設層
Google 正與 Apple、NVIDIA、OpenAI、ElevenLabs、Kakao 等夥伴推動 SynthID 互通,方向明顯指向跨廠商的統一驗證框架,令「哪一家模型寫的」在技術上變得可查,Microsoft 今年 2 月的媒體完整性報告則提醒業界,C2PA 溯源、水印與指紋技術各有盲點,單靠任何一種都攔不住數碼欺騙,文字水印尤其容易被改寫、翻譯與拼貼削弱。
短期之內市場會出現偵測服務、去水印工具與學術爭議並存的混亂期,AI 偵測軟件供應商亦要重新定位,因為基於文風「破綻」的統計猜測,與持鑰驗證屬於完全不同的方法論,中長期而言內容憑證很可能像 HTTPS 一樣沉降為基礎設施,由平台預設處理,用戶不再感知。Anthropic 這次選擇一個成本近乎零、效果只屬半有效的方案,本身已經說明企業心態:合規展示的優先次序,暫時高於防偽本身的嚴密程度。真正的分水嶺,將會落在偵測 API 開放之後,市場如何界定「AI 參與」的合理披露門檻。
來源:Anthropic




