工作

AI初稿里的水印,说明不了你改了多少

如果你经常把AI生成的初稿整理成报告或策划书,有一项变化需要了解。OpenAI和Anthropic宣布,将在AI生成的文本中加入不可见水印。但这种标记只能说明,AI系统生成或处理过文本的一部分。自己改了什么、核实了什么,仍需另行记录在稿件版本历史和笔记中。

标记只能说明一件事

OpenAI明确区分了水印能做什么、不能做什么。标记只能说明,OpenAI的系统生成或处理过文本的一部分。它无法说明谁使用了该系统、人做了多少贡献、文章属于谁,或内容是否正确[1]。Anthropic也表示,水印不包含有关个别用户的信息[2]。

要问的问题水印给出的答案
AI系统是否生成或处理过部分文本检测到标记,就说明是
谁使用了该系统无法说明
人做了多少贡献无法说明
文章属于谁无法说明
内容是否正确无法说明
未检测到标记,是否说明是人写的不能作为人写的证据

目前哪些文本会加上标记

OpenAI于2026年10月5日宣布,将在接下来的数周内,为ChatGPT和Codex在欧盟生成的适用文本加入不可见水印。从同一天起,全球API客户也可以在部分模型上自行启用这项功能。不过,API中的默认设置是关闭,推出时也不会在全球默认启用[1]。

在此之前,Anthropic已于8月14日宣布,将在后续推出的Claude模型生成的文本中加入水印。由于没有可靠的方法按地区区分实施,因此从一开始就会在全球应用[2]。这意味着,在韩国用Claude起草工作文档的人,从新模型开始也会纳入适用范围。

OpenAI采用的方法是textGrain。它在词语选择中加入统计信号,留下人眼看不见、但检测器能通过统计识别的模式[1]。Anthropic则以Google DeepMind于2024年在学术期刊《Nature》上发表的SynthID-Text方法为基础[2]。

仅凭检测结果,量不出改了多少

从AI Matters报道的数据来看,水印检测率会随文本长度和修改程度而变化。将误报率设为1%时,长度为400 token的文本约有95%被检测出,200 token的文本约有80%被检测出。在400 token的文本中,将10%的词语替换为同义词后,检测率从约92%降至66%;替换25%后,则降至17%。数学文本的检测率要低得多[3][4]。

Anthropic的解释也指向同样的结论。该公司表示,轻度修改不会让标记完全消失,但如果重写时换掉所有词语,标记就会消失[2]。

因此,不能把检测结果的高低当作自己的贡献程度。仅把部分词语换成同义词,检测率就会下降,但这并不意味着文章中融入了更多自己的判断。OpenAI也明确表示,仅凭标记无法得知人做了多少贡献[1]。

检测器也并非人人都能使用。OpenAI初期只向获批的研究人员和专业机构开放检测器[1]。Anthropic的检测API仍处于非公开预览阶段,面向欧盟法律规定的机构和群体(监管机构、执法机构、媒体、事实核查员、独立研究人员、教育机构、欧盟公民社会组织),以及为合规而负有核查义务的企业[2]。目前还不是团队主管或公司审核人员提交文档后,就能立即得到判定的阶段。

用稿件历史和笔记记录自己的工作

以AI初稿为基础撰写文档的人,若想展示自己所做的贡献,就需要标记之外的记录。展示修改过程的稿件版本历史、参考资料清单,以及记录工具使用阶段的笔记,都可以发挥这个作用。

笔记中应包含的项目,与书稿的记录并没有太大区别。「写稿时用了AI,该向出版社说明什么」这篇指南提出的四栏(工具、使用阶段、使用范围、人工核验的内容),也可以直接用于工作文档。如果提问的是团队主管或客户,而不是出版社,同样可以用这份记录作答。

对于工作文档,做好三件事即可。

  • 将AI给出的初稿按收到时的原样单独保存。没有最初的版本,就无法对比改了什么。
  • 每次大幅修改时,都另存一个版本。在名称中注明做了什么,例如调整结构的版本、核实数据的版本。
  • 在文档末尾或单独的笔记中,记录参考资料和使用工具的阶段。
提交前临时补上的一句话
参考AI初稿撰写。
修改过程中留下的笔记
收到的初稿:用对话式AI服务生成目录和首段,原样保存为v1修改内容:重写结论段,将数据与公司内部资料核对(v2)参考资料:上一季度的业绩资料、客户访谈笔记人工核验内容:引用的所有数据和日期

法律将标记义务交给了谁

欧盟《人工智能法》第50条规定的透明度义务,自2026年8月2日起适用。利用AI生成文本的系统提供者,必须在输出内容中加入机器可读的标记,使其能够被检测。辅助常规编辑的功能,或未对输入作出实质性改动的情况,属于例外。8月2日之前已投放市场的生成式AI系统,可获得截至2026年12月的宽限期[5]。

发布文本的一方也有义务。如果为了向公众介绍公共关注事项,而发布未经人工审核或编辑责任把关的AI生成文本,就必须添加用户能够识别的标识。相反,经过人工审核并由人承担责任的文本,可免于这项标识义务[5]。

标记也无法体现你承担了审核和编辑工作。这份记录同样需要由人留下。

韩国的人工智能基本法于2026年1月22日施行。对于并非深度伪造的AI生成内容,可以使用不可见水印代替可见标识。政府决定,自施行之日起设置至少一年的宣传指导期,在此期间暂缓事实调查和行政罚款[6]。

参考资料

  • [1] OpenAI开发者社区,OpenAI's approach to EU text provenance rules,2026年10月5日。
  • [2] Anthropic,How Claude's text watermarking works,2026年8月14日。
  • [3] AI Matters,2026年10月6日报道。
  • [4] TechCrunch,2026年10月5日报道。
  • [5] 欧盟委员会,Quick Facts: Transparency rules for AI systems。
  • [6] 科学技术信息通信部,人工智能基本法新闻稿。

常见问题

未检测到水印,能证明文章是我写的吗?

不能。OpenAI明确表示,未检测到水印,并不能证明文本是人写的。可能使用了其他公司的模型,也可能是在修改过程中,信号变弱了。要证明自己写了什么,需要保留各版本稿件和笔记。

水印中会包含我的姓名或账号信息吗?

Anthropic表示,水印中不包含能够识别用户身份的信息。OpenAI也解释,仅凭标记无法得知谁使用了该系统。标记所能说明的,仅限于AI系统是否生成或处理过文本的一部分。