Anthropic全面导入「隐形浮水印」!複製文字、生成图片都能追溯来源
人工智慧(AI)大厂 Anthropic 近日宣布,将为旗下 Claude 系列模型全面导入机器可读内容标记机制,未来由 Claude 生成的文字内容都将被植入肉眼无法察觉的隐形浮水印,图片等档案则会附上经数位签章的来源资讯。
根据 Anthropic 週二(11 日)发布的官方说明,这套机制与市面上多数仅依附在档案元资料(metadata)的标记方式不同。
Claude 的文字浮水印是直接编织进内容本身。也就是说,即使使用者将 AI 生成的文字複製到其他平台、甚至进行部分改写,浮水印仍有机会留存,使追蹤 AI 生成内容的能力较过往方案大幅提升。
至于图片档案,Anthropic 则採用另一套作法:当 Claude 产出如 SVG、PNG、JPG 等格式的档案时,系统会自动附加经数位签章的溯源资讯,并遵循目前业界广泛採用的内容溯源与真实性联盟(C2PA)公开标準。
只要档案带有这项签章标籤,就能作为该内容曾经过 Claude 处理的佐证,同时也有助于判断档案是否遭到后续窜改。
促使 Anthropic 此时祭出这项措施的关键背景,是该公司已签署欧盟《人工智慧法案》第 50 条第 2 项下的《AI 生成内容透明度行为準则》。
依规定,凡自 2026 年 8 月 2 日起于欧盟境内推出的新版 Claude 模型,都必须从上市当天起就具备内容标记能力。
值得注意的是,Anthropic 强调这项标记机制并非仅为满足欧盟法规而设的区域限定措施,而是将全面适用于 Claude 旗下所有产品线与合作云端平台,範围涵盖全球市场。
目前确定纳入的服务包括 Claude Platform(API)、Claude 应用程式本身、Claude Code、Claude Cowork,以及 Claude Tag,同时也适用于透过 AWS、Google Cloud 与 Microsoft Foundry 等云端伙伴管道使用 Claude 的用户。
至于在此规範上路前已经发布的既有模型,由于欧盟法规设有过渡缓冲期,Anthropic 表示正着手为这些旧款模型加装标记功能,细节将于后续陆续公布。
在推出新机制的同时,Anthropic 也罕见地在官方文件中详细列举了这套系统的侷限,提醒外界不宜将其视为绝对可靠的鉴别工具。
该公司指出,即便侦测到 Claude 的标记,也只能说明内容有可能经过 Claude 处理,无法百分之百还原完整的内容来源。
举例而言,许多使用者其实是拿既有文件请 Claude 协助校对、翻译、摘要或格式转换,这类输出虽然带有 Claude 的标记,但文字背后的原始构想、论述甚至数据,其实另有出处;内容也可能在 Claude 处理完毕后,又经过使用者进一步删修、节录或与其他素材合併。
反过来说,没有侦测到标记同样不能作为内容并非 AI 生成的证明。
Anthropic 列出多种可能导致标记缺失的情境,包括:内容是由标记功能上线前的旧版模型所产出;文字经过大幅改写、翻译或与其他内容混杂;段落篇幅过短,不足以承载可辨识的讯号;档案在转档、另存新档或截图过程中遗失了原始元资料;又或者内容本身来自尚未支援该类标记技术的平台或档案格式。
针对将 Claude 技术整合进自家产品的企业与开发者,Anthropic 在说明中特别提醒,各家业者仍应依据《人工智慧法案》第 50 条的规定,自行评估相关透明度义务对其产品与服务所带来的具体要求。
换言之,即便 Anthropic 已在技术层面提供标记工具,下游开发者的合规责任并不会因此自动转移或免除,仍须主动釐清自身在法规框架下应承担的义务範围。