OpenAI、Anthropic、Google等签署欧盟AI内容透明度准则
包括OpenAI、Anthropic、Google、Meta、Microsoft在内的多家公司签署了欧盟《AI生成内容透明度行为准则》,承诺推进AI生成内容的标记与检测。Anthropic率先公布了Claude的具体方案,包括嵌入文本水印和C2PA元数据。此举旨在提高AI内容透明度,但也引发了对水印可靠性和责任转移的讨论。
包括OpenAI、Anthropic、Google、Meta、Microsoft在内的多家公司签署了欧盟《AI生成内容透明度行为准则》,承诺推进AI生成内容的标记与检测。Anthropic率先公布了Claude的具体方案,包括嵌入文本水印和C2PA元数据。此举旨在提高AI内容透明度,但也引发了对水印可靠性和责任转移的讨论。
SynthePulse Insight · AI 深度解读
版本 1 · 1 个来源
欧盟《AI生成内容透明度行为准则》签署后,Claude率先落地文本水印,但水印的可信度与责任转移引发争议。本文梳理事件脉络、技术原理与不确定性。
2026年8月,包括OpenAI、Anthropic、Google、Meta、Microsoft在内的一大批公司签署了欧盟《AI生成内容透明度行为准则》,承诺推进AI生成内容的标记与检测。这一准则的背景是欧盟法案中关于内容透明度的要求自8月2日起生效:AI生成或操纵的文本、图像、音频和视频,需要以机器可读的方式标记,并且能够被检测出来。
OpenAI表示,根据其对准则的承诺,目标是将来源信号扩展至包括文本在内的所有模态。这意味着未来AI内容可能普遍带有“署名”。
Anthropic是首个公布具体方案的签署方。根据其支持文档,从8月2日起,在欧盟推出的新Claude模型在“AI水印”上线时即启用;旧模型则根据欧盟过渡期,应在12月2日前补上水印。
水印直接嵌入生成文本中,人眼不可见但机器可检测,复制粘贴后保留,甚至经过一些编辑后也不一定消失。对于svg、png、jpg等文件,Claude会附加经过数字签名的来源元数据,采用C2PA开放标准,表明文件曾由Claude处理,并帮助判断是否被篡改。
这套机制不局限于欧盟用户,且水印从模型层加入,无论通过Claude、API还是第三方云服务调用,生成内容都会带上水印。按目前节奏,到12月2日后,Claude的水印将覆盖全球、全模型、全渠道。
文本水印并非新鲜概念。早在2024年,DeepMind就公开了SynthID Text方案,并已用于Gemini和Gemini Advanced。其原理是在大模型生成文字时,对token的生成概率做非常轻微的调整,使模型选词时留下特定统计规律,整段文字生成后累积形成水印;检测时反向检查词语选择是否符合带水印文本的统计模式。
Google公开测试显示,裁掉部分文本、修改少量词语或轻度改写时,仍可检测出信号;但彻底重写或翻译成另一种语言,检测置信度可能大幅下降。Google还曾在接近2000万条Gemini真实响应中测试,结果显示加入水印后用户对文本质量的评价基本没有变化。
水印的可信度遭到质疑。Anthropic自己提到,有水印不一定就是AI,同时经过大量改写或混入人工内容,水印会被削弱甚至检测不出来。这意味着水印并非绝对可靠的AI内容标识。
评论区出现两种声音:一种呼吁“退订”,另一种认为使用什么工具不重要,最终质量才是关键。有观点指出,强调“这部分用了AI”其实有提醒读者核查事实的意味,但这也可能将原本属于内容生产者或平台的核查压力,在不知不觉中推向读者和接收者。
本文信息主要来自机器之心对OpenAI公告和Anthropic支持文档的转述,属于二手报道。具体技术细节(如SynthID Text的测试数据)来自Google公开信息,但未经独立验证。签署公司名单、时间节点等以官方公告为准,但本文未提供原始链接。
欧盟准则推动AI内容水印从承诺走向落地,Claude率先实现全球覆盖,但水印技术的局限性和责任转移问题表明,AI内容的可信度仍需多方共同维护。
主报道
主报道来源