Anthropic 宣布,之後的 Claude 模型會在生成的文字裡自動加上 浮水印(watermark)藏在內容裡、不影響觀感但可被特定方法偵測出來的隱藏標記,用來判斷「這段文字有多大機率是 Claude 寫的」。這個動作是為了配合 2026 年 8 月上路的 歐盟AI法案(EU AI Act)歐盟訂定的AI監理規範,要求在歐盟市場提供服務的AI業者必須標示AI生成內容,而且不只 Anthropic,其他簽署同一份規範的主要 AI 業者也會各自推出自己的浮水印。
運作原理跟你想的「藏字」完全不同。大型語言模型(LLM)像Claude這樣一次只預測一個字/詞的AI模型 每次選下一個字時,其實是從一份候選清單裡挑,例如「今天天氣又冷又…」後面接「陰沉」還是「灰濛濛」,意思差不多,選哪個通常交給 亂數產生器(random number generator)決定「隨機」結果的演算法元件 丟骰子決定。Anthropic 的做法是把這個「丟骰子」的來源,換成用一把只有官方持有的密鑰(key)搭配前面幾個字去計算出來的偽隨機結果——文字讀起來一模一樣,但只要有這把 key,就能檢查整段文字的選字規律是否符合「Claude 用這把 key 會選的樣子」,進而算出一個「這是 Claude 寫的」機率。