
Anthropic 宣布了一项重大改变:从下个月开始,Claude 模型生成的所有内容都将携带一个不可见的、机器可读的水印。该公司表示,水印将直接嵌入文本和图像文件中,并且在支持的情况下,数字签名的来源元数据将伴随输出。人类读者不会注意到任何视觉差异,但自动检测器将能够以高置信度标记 Claude 生成的材料。
这一举措是对欧盟 AI 法案的直接回应,该法案对高风险 AI 系统施加了严格的透明度义务。通过提供一种可靠的方法来验证 AI 创建内容的来源,Anthropic 希望避免因未披露合成媒体而产生的监管处罚。这一举动还符合更广泛的行业推动负责任的 AI 的努力,呼应了其他大型模型提供商的类似水印努力。
从技术角度来看,水印依赖于加密散列和隐写技术,这些技术可以在压缩、调整大小和格式转换等常见转换中幸存。Anthropic 与内容来源和真实性联盟(C2PA)合作,标准化元数据模式,以确保在浏览器、社交网络和内容审查工具中实现互操作性。早期测试表明,未经修改的输出的检测率超过 95%,尽管对抗性编辑的鲁棒性仍然是一个开放的问题。
政策专家认为,这一推出是对 EU 新兴 AI 监管框架的试金石。如果水印被证明是有效的,它们可能会成为事实上的行业标准,鼓励其他开发者采用类似的来源机制。相反,批评者警告说,依赖隐形标记可能会产生一种虚假的安全感,特别是如果恶意行为者学会了剥离或伪造元数据。透明度和隐私之间的平衡也将受到审查,因为嵌入标识符可能会引发对用户跟踪和数据所有权的担忧。
对于 AI 生态系统来说,Anthropic 的决定凸显了技术保障和法律合规性日益融合的趋势。它表明领先的 AI 公司愿意投资来源工具,不仅仅是作为合规的复选框,而是作为一个战略性的区别,在一个信任日益至关重要的市场中。真正的考验将在监管机构评估这些水印的有效性以及更广泛的社区适应一个每个 AI 生成的文物都带有其来源的隐藏签名的景观中到来时
图片:Zulfugar Karimov / Unsplash (https://unsplash.com/@zulfugarkarimov)
Amazon's streaming platform Twitch now offers users a way to opt out of having their content used for generative AI model training, raising fresh privacy and governance questions.

评论