Anthropic 近日透露,将很快对其模型处理(不仅仅是生成!)的所有内容添加隐性水印。#Anthropic 在其官方支持文档中解释称,此举是为了部署机器可读水印,以遵守欧盟的《AI法案》(EU AI Act)。该法案要求所有 AI 系统提供商对 AI 生成或篡改的音频、图像、文本和视频输出进行水印标记。该法律适用于今年 8月2日 之后发布的任何 AI 模型,并为先前发布的模型提供了截止至 2026年12月 的过渡期。
Anthropic 确认,未来在全球范围内推出的所有新模型——而不仅仅是在欧盟地区——都将从“第一天”起对 AI 生成的内容进行标记。对于文本输出,#Claude 将携带用户不可见的嵌入式水印,而其他生成的媒体文件在支持的情况下,将包含数字签名的C2PA来源元数据。
值得注意的是,Anthropic 采取了一种“一刀切”的严厉方案:只要技术支持,它将对所有经由其模型“处理”过的内容添加水印。然而,欧盟法案实际上豁免了那些仅执行“标准编辑辅助功能”(如语法纠错)或未“实质性改变”用户文本原意的 AI 处理行为。
由于在模型层面应用的水印无法区分“全文生成”与“逗号修正”,Claude 最终可能会对那些法律本意不予标记的内容强行盖章。在 Anthropic 发布可供测试的检测工具之前,我们很难评估这种水印的实际覆盖度和鲁棒性。该公司表示,计划最终分享检测水印的具体细节,以提供欧盟法律所要求的技术支持。此外,Anthropic 还指出,水印在某些不支持该技术的平台或功能上将无法生效。
Anthropic 此次“宁可错标,不可漏标”的全球水印策略,标志着 AI 合规化进程迈出了激进的一步。从 AI Agent 生态的角度来看,这种模型层面的隐性水印将对“人机协同”的工作流带来深远影响。当 Agent 被深度集成到企业日常工作(如文档润色、代码辅助)中时,混合型文本的权属与合规判定将变得极度复杂。与 OpenAI 或 Google 相比,Anthropic 选择从底层全面推行水印,虽然在监管合规上抢占了先机,但这也可能导致用户对“使用 Claude 润色即被打上 AI 标签”产生抵触心理,从而倒逼开发者寻找更清洁、无污染的开源替代方案(如 Llama 3 系列)。未来,如何在保障合规的同时,精准区分“辅助代理”与“完全生成”,将是整个 Agent 行业需要共同攻克的底层技术难题。