Skip to article
← 返回情报台

Anthropic 水印计划显示监管正在进入模型内部

欧洲透明度义务生效后,新 Claude 模型将标记生成文字,并为文件加入来源信息。

编辑判断

AI 内容披露正成为基础设施功能,而不是发布者最后补上的标签。

Anthropic 表示,在欧盟透明度规则生效后推出的模型,将为生成文字加入标记,并在支持的图像文件中加入来源信息。措施回应《AI 法案》第 50 条,目标是让合成或被操控的内容可以被识别。

真正重要的是架构变化。可见提示在内容被复制后容易消失,文件元数据也可能在导出时被移除;模型层水印试图把统计信号留在输出本身,但它的耐用程度、误判率以及第三方能否可靠检测,仍有待验证。

对企业来说,披露已经不能只当作发布前的最后一个勾选框。内容系统需要在编辑、翻译和分发过程中保留来源链,并说明人工工作何时已经实质改变 AI 草稿。监管开始直接塑造生成技术栈。

来源说明

本简报综合已报道事实并加入独立背景,不复制来源文章的措辞或结构。