一条关于“AI文本隐形水印”的消息,最容易被读错的地方,是把监管要求和厂商产品安排当成了同一件事。欧盟已经确定要让部分AI生成内容可识别,也规定了特定场景下的清晰、可见标注;但OpenAI那篇名为“EU text provenance”的官方页面,截至发稿仍无法读取正文,因此目前不能确认它是否已经决定给哪些ChatGPT或Codex文本加入何种标记。
这对使用AI写客服话术、代码说明和营销文案的团队很重要:合规方向可以先看清,OpenAI具体怎么做却不能靠标题或传闻补全。两件事混在一起,最容易把一项可能的安排写成已上线功能。
欧盟已经规定:AI生成内容要能被识别
欧盟委员会对《人工智能法案》(AI Act)的说明写得很清楚:生成式AI提供者需要确保AI生成内容具备可识别性。对深度伪造内容,以及以告知公众公共利益事项为目的发布的特定AI生成文本,还需要进行清晰、可见的标注。
这套透明度规则将于2026年8月2日起适用。它关注的是内容是否能被识别、特定内容是否向公众明确披露,并没有在这页概览中指定所有公司必须采用某一种技术。
换句话说,法律先规定“要达到什么结果”,不等于已经规定“必须用统计水印实现”。一家公司可以采用机器可读的标记、检测机制或其他合规方案,但仍需证明方案足够有效,并符合适用场景的要求。
欧盟委员会已经发布《AI生成内容透明度实践准则》。准则覆盖两类工作:一类面向提供者,涉及对音频、图像、视频和文本输出进行机器可读标记,并让内容可被识别为人工生成或操纵;另一类面向部署者,涉及深度伪造和特定AI生成文本的公开标注。
这里有一个不能省略的区别:准则是自愿采用的合规工具,Article 50规定的透明度要求本身则是法律义务。委员会表示,签署并遵循准则的提供者和部署者,可以用其中的措施证明合规;选择其他办法的企业,则要证明自己的措施同样适当。准则不会取代AI Act或委员会关于透明度义务的指引。
OpenAI具体覆盖哪些文本,目前不能下结论
OpenAI的相关页面标题指向“欧盟文本溯源”,但正文目前无法从公开页面读取。因而,以下关键信息都不能当作已经确认的产品事实:适用的是ChatGPT、Codex,还是其他产品;范围按地区、模型、语言还是文本类型划分;安排处于研究、测试、计划还是部署阶段;以及外部机构如何检测、研究者能否访问相关工具。
尤其不能把“部分文本”扩写成“所有ChatGPT回答”,也不能把它直接写成“所有Codex代码都会被标记”。一个限定词可能决定它是小范围合规安排,还是会改变企业日常工作流的产品更新。
同样,目前无法判断哪些输出会被标记、标记是否会随复制和编辑保留,也无法判断它是否具备可追踪性。短文本、翻译文本、人工润色文本和人机混写内容是否属于同一检测范围,都需要OpenAI公开可核验的说明或测试结果,不能由欧盟法规反推。
这也是“隐形水印”一词需要谨慎使用的原因。它至少不同于直接写在文章页面上的“AI生成”字样,也不必然等同于文件元数据;但在没有OpenAI正文的情况下,我们不能进一步断言它采用了哪一种具体机制,更不能据此推测准确率、抗改写能力或误判率。
对产品团队,先别把标题写进需求文档
现阶段,企业可以做的是把欧盟透明度义务纳入内容治理规划:明确哪些AI生成内容需要被识别,哪些面向公众的文本可能触发可见标注,并保留对供应商合规说明的核验环节。
但在OpenAI发布可读取的官方说明之前,不宜据此修改用户协议、向客户承诺“所有输出都有水印”,或把某种检测能力写成已经可用。平台和媒体也应把“可能来自AI”与“内容是否真实”分开:前者是来源识别问题,后者仍需要事实核查。
最稳妥的判断只有一句:欧盟对AI生成内容的透明度要求已经明确,OpenAI是否按何种范围和方式落实到ChatGPT、Codex或其他文本输出,当前仍不能从这篇无法读取正文的官方页面确认。接入或采购前,先向供应商要三样东西:适用范围、检测与误判说明,以及编辑或改写后标记是否仍然有效。
来源
- 欧盟委员会:AI Act说明
- 欧盟委员会:AI生成内容透明度实践准则
- 欧盟委员会:AI Act第50条
- OpenAI:EU text provenance页面(截至发稿无法读取正文,未据此确认产品细节)


