為遵守歐盟 AI 法案,Anthropic 表示,未來在歐盟推出的模型所生成文字與檔案,都將嵌入浮水印或標記。
Anthropic 周一公布的文件指出,由模型生成的文字將嵌入浮水印;由模型生成的檔案,則會在 metadata 中加入含數位簽章的標記。此外,Anthropic 也正在作業,在歐盟 AI 法案上路的過渡期間,讓已推出的模型加入輸出標記。這項新措施將適用於全球提供的 Claude 模型,也將涵蓋 Anthropic 模型的第三方供應商,包括 AWS 、 Google 與 Microsoft Foundry 等。
為符合歐盟法規,Anthropic 計畫日後在文件中提供使用者偵測 Claude 標記的方法。 Anthropic 說,當 Claude 模型生成文字時,會將看不見的浮水印織入文字本身。使用者肉眼無法辨識,且不會改變 Claude 回應的意義、品質與可讀性。由於浮水印是文字的一部分,因此文字在不同位置複製貼上時,浮水印也會一併保留,且在經過某些編輯方法後仍可能存在。無論文字由哪個 Claude 模型生成、透過哪個介面輸出,都會帶著浮水印。
Anthropic 也計畫讓多項產品的輸出加入標記,包括 Claude Platform(API)、 Claude 、 Claude Code 、 Claude Cowork 與 Claude Tag 等。
不過,這項作法可能進一步激發市場對開放權重模型的呼聲,也可能使不希望消費者得知 AI 生成內容來源的企業客戶重新評估。過去 Claude 也曾多次遭用戶抱怨,包括價格調整、穩定性不佳,以及以安全為由設置護欄、導致模型拒絕回答部分問題等。
另一方面,Claude 用戶也質疑加浮水印的效果。過去曾有研究人員展示,圖片浮水印可被移除。由於 Anthropic 未提供範例或技術文件,外界難以判斷其文字浮水印為何不易去除。不過,若建立光學字元辨識系統(OCR)以去除或忽略生成文字中的標記,技術上可能並非難事。
Anthropic 強調文字標記方法「不會變更生成文字的意義」,外界推測這可能排除以文字與位置進行來源辨識的作法。相傳蘋果曾利用文字與位置等方式,追查違反保密協定的員工。至於 Claude 生成檔案附加的標記,Anthropic 表示採用 C2PA 標準的簽發來源 metadata,但目前已有開原工具可移除相關資訊。
Anthropic 也坦言,偵測到標記不必然代表內容由 Anthropic 的 Claude 生成;反之,若未偵測到標記,也不代表內容生成未使用 AI 。不過,即使如此,仍足以讓 Claude 符合歐盟法規要求。
(綜合外電報導)
