刷到一篇 " 干货满满 " 的文章,读完才发现是 AI 写的;看到评论区的高质量回答,分不清对面是真人还是大模型;就连朋友圈里那段 " 走心 " 的文案,也越来越难判断背后敲键盘的是谁 ……
当 AI 写的东西越来越像人,人写的东西又越来越像 AI," 作者到底是不是真人 " 是这个时代最玄学的问题之一。
Claude 在近日上线文本隐形水印功能,给所有模型产出的内容做标记。这意味着,今后从 Claude 里流出的每一段文字,都将自带一份 " 出生证明 "。
但水印只能证明 AI 参与过,证明不了全文都是 AI 的产物,例如,若稿子只是经过 Claude 润色,也会被打上 AI 标签,原创者反而可能被 " 冤枉 "。而对于刻意隐瞒者而言,大幅改写、翻译、短文本都可能让标记失效。
这场 AI 与反检测的 " 猫鼠游戏 ",才刚刚开始。
具体来说,Claude 主要用两种方式给生成的内容打上来源标记,两套机制互相配合。
第一种是藏在文字里的隐形水印。模型输出文字的时候,会悄悄把水印揉进文本当中,人眼完全看不出来,也不会影响文章的意思和阅读体验。只要复制粘贴这段文字,水印会跟着一起走,就算做一些简单修改,水印也还有机会保留下来。这种情况下,不管用 Claude 哪个功能页面生成文字,模型都会统一加上这个水印。
第二种是带签名的溯源信息,只针对图片、SVG 这类文件。Claude 产出这类文件时,会给文件附上一套遵循 C2PA 行业标准的溯源数据。有了这份数据,既能看出这份文件是 Claude 处理过的,还能检查文件有没有被人篡改过。
Claude 还表示,未来官方还会开放检测工具,不管是普通用户还是第三方,都可以去查验文字或者文件有没有 Claude 的标记,如果查到标记就说明这份内容很可能出自 Claude。

而根据 Claude 在官网发布的公告,上述标记覆盖全球所有 Claude 提供服务的地区。
用户无论是在 Claude 网页、API 接口、Claude Code、Cowork、Tag,还是通过 AWS、谷歌云、微软 Foundry 等第三方云平台调用模型,只要是支持该功能的模型,产出的内容就会带上标记。
不同的是,用来证明内容是 AI 产出的溯源凭证不一样,只有用户上传文件直接通过 Claude 相关处理时才会生效,部分第三方云平台调用 Claude 时,隐形水印会正常存在,但可能拿不到这份溯源凭证。
事实上,Claude(Anthropic)并不是首个提出赋予 AI 生成文字 "DNA" 的公司。此前,谷歌 DeepMind 和马里兰大学的研究团队就已经在文本水印领域取得了突破。
2023 年 4 月。美国马里兰大学的研究团队在论文《A Watermark for Large Language Models》中,首次提出了一种针对大语言模型的统计水印方法。学术界视其为给 AI 文本打 "DNA" 的开创性工作之一。
2024 年 10 月,谷歌 DeepMind 在《自然》杂志上发表了关于 SynthID-Text 的研究。这项技术通过一种 " 锦标赛采样算法 ",将水印直接整合到大语言模型生成文本的步骤中,是首次在现实世界中大规模部署的文本水印技术,已经应用在了 Gemini 聊天机器人上。
上述技术的原理,是通过调整模型在生成过程中选择词语的概率分布,让生成的文本在统计特征上带有某种特定的规律。这种规律对人类读者完全不可见,但可以通过特定密钥检测出来,就像给文本打入了 AI" 烙印 " 一样。
不过,目前 Claude 暂时还未公布加隐性标识背后的具体技术原理。
尽管 Claude 有办法给文字加上自己的专属标记,但其可靠性仍有待验证。
根据 Claude 官方的阐述,首先,查到标记 ≠ 就是 AI 写的。用户使用 Claude 改稿子、翻译、总结别人的内容,输出内容后,照样会带上标记,而且在 AI 输出之后,人还可以改、剪、拼接别的内容,标记只能证明 AI 碰过这份内容,不能保证现在看到的全部都是 AI 原生产出。
其次,就算查不到标记,也不代表没用过 Claude。涉及到老版本模型、文字被大改翻译、文字太短、部分平台不支持标记等等,这些情况都可能会导致标记消失。
目前,市面上涌现出不少可以测 AI 率的工具,如腾讯朱雀 AI 检测、XYZ SCIENCE、Decopy AI、Wordvice AI 等。查阅它们的官网介绍,这些工具多先使用大量 AI 写的、真人写的各类内容训练模型,专门揪出 AI 行文的固定句式、用词套路等内在特点,并且跟着新 AI 模型更新算法,最后量化算出文本 AI 生成占比,识别 AI 写作痕迹。

有意思的是,这些 AI 检测网页中,同时伴有的功能是——降 AI 率。用 AI 检测 AI,再用 AI 降低 AI,玩了一把 " 以子之矛,攻子之盾 "。
在电商平台上,也不乏降 AI 率的生意,开机实验室选取销量较高的商家问询。


从收费上来看,开机实验室参考几家报价,万字文本的价格在 28、29 元上下,实现方式主要有两种:一是通过自助软件降 AI,支持整文上传或分段修改,宣称可将 AI 率降至 20% 以下;另一种是后台算法批量改写,商家称能降到知网 10% 以下。

不过,这些商家都不约而同地提到了一点——目前暂无法去除 Claude 生成的标识。
不过无论是给 AI 文本打上 " 烙印 " 还是为 AI 文本 " 去 AI 味 ",背后都是同一个动因。
近年来,AI 模型智能化水平快速跃进催生了全球监管需求。其中欧盟《人工智能法案》第 50 条第 2 款关于 AI 生成内容强制透明标记的合规规定。该条款明确要求生成式 AI 厂商为 AI 产出文本、音视频等合成内容增设机器可读、可溯源检测标记。
在国内,2025 年 9 月 1 日,国家网信办、工业和信息化部、公安部、国家广播电视总局联合制定的《人工智能生成合成内容标识办法》(下称《办法》)正式生效。该办法也提出了强制添加显式和隐式标识等规范要求,其中,显式标识是指在生成合成内容或者交互场景界面中添加的,以文字、声音、图形等方式呈现并可以被用户明显感知到的标识。

针对文本内容,《办法》明确要求添加的显式标识是在文本的起始、末尾或者中间适当位置添加文字提示或者通用符号提示等标识,或者在交互场景界面、文字周边添加显著的提示标识。
而对于隐式标识,《办法》要求在生成合成内容的文件元数据中添加,要包含生成合成内容属性信息、服务提供者名称或者编码、内容编号等制作要素信息。所谓文件元数据指的是,按照特定编码格式嵌入到文件头部的描述性信息,用于记录文件来源、属性、用途等信息内容。
这也就意味着,只有获取到原始的 AI 生成文件,才能通过技术手段读取到隐藏在文件头部的这些描述性信息。由于它并非直接呈现在画面或文字表面,一旦文件经过截图、录屏、格式转换或二次编辑,这些元数据就极易丢失或被抹除,从而导致标识失效。
《办法》也表示,鼓励服务提供者在生成合成内容中添加数字水印等形式的隐式标识。
从国内厂商侧来看,各模型厂在显示标识上多采用水印,如 "XXAI 生成 "、"XXAI" 等字样,一般见诸于 AI 生成的视频和图片,放置于画面角落。文本则较少添加提示标识。
而目前抖音、B 站、小红书等内容社交平台,以及豆包、即梦等 AI 生成工具平台,均依据《办法》建立了 AI 内容双标识管理体系:一方面要求创作者、使用者主动添加文字、角标、文案备注等可直观感知的显式标识,平台配套提供一键打标、发布声明等功能辅助用户合规标注;另一方面平台与 AI 生成工具会在文件元数据内嵌包含生成来源、编号等信息的隐式 AI 标识,同时明确禁止任何人删除、篡改、隐匿 AI 标识。


登录后才可以发布评论哦
打开小程序可以发布评论哦