合规动态

从Claude标记方案看欧盟AI生成内容透明度实践准则的实施要求

从Claude标记方案看欧盟AI生成内容透明度实践准则的实施要求

Anthropic近日公布了Claude标记AI生成内容的安排。受支持模型生成的自由文本将带有不可见水印,SVG、PNG和JPEG等文件将附带C2PA签名来源元数据。相关安排将用于Claude、Claude Platform、Claude Code和Claude Cowork,并计划覆盖部分第三方云平台上的Claude模型。

Anthropic已经签署欧盟《AI生成内容透明度实践准则》(以下简称“实践准则”)Section 1,承诺按照其中的技术要求标记AI生成或操纵的内容。对照Claude的具体方案,可以进一步了解Article 50(2)进入产品实施阶段后,模型提供者需要完成哪些工作。

一、机器标记的技术框架

《欧盟人工智能法案》Article 50(2)要求生成式AI系统提供者以机器可读格式标记系统输出,并使其能够被识别为人工生成或操纵。实践准则进一步规定了标记的技术形式和查验方式。模型提供者需要在输出中写入标记,并为相应标记提供检测工具,使外部主体能够查验内容来源。

实践准则属于自愿性合规工具,相关法律义务仍以AI Act为依据。欧盟委员会同时明确,实践准则不取代AI Act或Article 50实施指南;签署方可以依据这套欧盟层面的共同框架设计措施并证明其履行相关义务。下文对Claude方案的分析,主要考察其公开措施与实践准则之间的对应关系。

对于图片、音频和视频等以文件形式传播的内容,实践准则原则上要求采用两层标记。带有数字签名的来源元数据记录生成工具、处理过程和签名信息;不可见水印则在元数据因截图、转码或平台重新编码而丢失时,继续提供识别线索。两项技术组合使用,可以提高标记在传播链路中的留存能力。

自由文本无法像图片文件一样稳定携带来源元数据,因此可以采用单层不可见水印。实践准则同时考虑了文本长度和后续编辑对检测效果的影响:超过200个token的文本原则上应当标记,很短的文本可以适用技术例外;文本经过大幅改写、翻译或混合后,检测结果也可能受到影响。

在标记写入内容之后,提供者还需解决查验问题。每一种标记都应配有相应的技术规范、软件或API。检测结果应当允许用户下载,并通过数字签名记录内容哈希、工具标识和时间戳。文本水印检测可以暂时只向监管机构、媒体和研究人员等专业用户开放,但提供者仍需说明开放对象和使用条件。

二、Claude的分层标记方案

Anthropic表示,2026年8月2日或之后在欧盟推出的新Claude模型将在发布时支持机器可读标记,既有模型将逐步增加支持。Claude根据输出类型分别采用文本水印和文件来源元数据,与实践准则对不同内容载体的分类基本一致。

(一)自由文本的不可见水印

Claude在生成自由文本时写入不可见水印。标记形成于模型生成阶段,复制文本通常不会使其立即消失;较大幅度的改写、翻译或内容混合则可能降低检测效果。

Anthropic同时限定了检测结果的证明范围。检出Claude水印,只能说明相关文本曾由Claude处理。用户可能使用Claude完成翻译、摘要或语言修改,检测结果无法据此确定整篇内容的作者,也无法证明当前版本未经编辑。未检出水印也不能直接排除Claude参与,因为旧模型、短文本和后续修改都可能影响结果。

水印可以作为内容来源判断的一项技术证据,仍需结合模型版本、文本长度、编辑记录和使用场景理解其证明力。

(二)图像文件的C2PA来源元数据

Claude生成受支持的SVG、PNG和JPEG文件时,将附带C2PA签名来源元数据。兼容工具可以读取相关凭证,确认文件是否曾由Claude处理,并核验受签名保护的信息是否发生变化。这一措施对应实践准则所要求的来源元数据层。

实践准则对图片等在线传播内容原则上还要求加入不可见水印。Anthropic目前公布的材料未完整说明Claude文件是否同时采用水印,也未披露仅使用C2PA元数据即可达到同等效果的测试依据。现有信息可以确认Claude已经实施来源元数据,尚不足以判断文件标记是否完整覆盖实践准则的双层方案。

其他厂商已经分别采用来源元数据和不可见水印。OpenAI为部分图像加入C2PA Content Credentials;Google DeepMind的SynthID可以在AI生成的图像、音频、文本和视频中嵌入不可见水印,并通过Gemini或SynthID Detector检测相关标记。厂商可以选择不同技术组合,但仍需说明标记如何写入、经过常见编辑后能否保留,以及外部用户如何检测。

三、检测工具与产品覆盖

Anthropic表示将向用户和第三方提供Claude标记的检测能力,但具体工具、开放对象和结果格式尚未公布。文本检测是否仅向专业用户开放、文件检测能否生成带签名的结果,以及误报和漏报如何解释,仍有待后续说明。

检测工具的设计关系到企业能否将结果用于合规留证。结果缺少内容哈希、工具标识和时间信息时,企业难以证明某项内容在特定时间接受过何种检测;检测入口无法覆盖不同接入方式时,企业还需分别设计核查流程。

检测工具之外,各产品的实际覆盖情况也需要确认。Claude的标记计划涉及多个产品、模型版本和第三方平台,Anthropic也提示,不同平台、功能和文件类型可能采用不同的标记方式。企业在供应商审查中需要记录所用模型、部署地区、输出格式和接入平台,并测试标记在复制、编辑、格式转换和外部发布后的保留情况。

四、下游企业的透明度责任

实践准则允许下游AI系统提供者沿用上游模型提供的标记、检测工具和测试材料,但最终输出是否符合Article 50(2),仍需结合下游产品判断。企业对Claude输出进行编辑、转换或重新封装后,应当确认最终内容是否继续带有适当标记,并保存版本和检测记录。

机器标记还需要与Article 50(4)规定的显式披露区分。企业公开发布深度伪造内容或特定公共利益文本时,可能需要直接向观看者或阅读者说明内容的AI生成或操纵属性。Claude水印和C2PA元数据主要供机器读取,无法自动完成面向自然人的披露。

综合目前公开的信息,Claude文本水印与实践准则对自由文本的技术路径基本对应,文件方案也已落实C2PA来源元数据。文件是否采用第二层标记、检测工具如何开放并记录结果,以及各模型和平台何时完成覆盖,将决定后续评估结论。相关信息明确之前,Anthropic的公开方案可以作为供应商审查和产品测试的依据,但还不足以支持对完整合规状态作出统一结论。

参考资料

《欧盟人工智能法案》正式文本欧盟委员会《Code of Practice on Transparency of AI-generated Content》Claude标记方案OpenAI内容来源方案Google DeepMind SynthID

开启你的合规之旅!

与 Kaamel 的隐私专家取得联系

https://kaamel.com
info@kaamel.com
340 E Middlefield Rd, Mountain View, CA 94043
AICPA Drata
© 2024 Kaamel Inc. All rights reserved.