
Anthropic、Google、OpenAI 文本水印技术引争议是合规之举还是对写作的歪曲2026 年 8 月 16 日周日本周作者在文章中提到Anthropic 宣布全球所有 Claude 模型很快会对包括文本在内的所有生成内容进行 “加水印” 处理以遵守欧盟规定。作者最初猜测他们可能会在文本中隐藏不可见的非打印 Unicode 字符但实际采用的是隐写术即在推理时通过选择特定的单词留下痕迹。作者轻信了 Anthropic 对其做法的描述以为系统不会篡改和破坏文本语义结果并非如此。昨天Anthropic 在新网站上发布文章解释了具体工作原理。James Padolsey 的文章对这项技术基本原理描述得最清晰。基于语义的水印技术是在生成下一个标记的每个决策点上模型根据 “绿色” 和 “红色” 单词列表对某些标记做出不同选择选择 “绿色” 列表中单词的可能性略高。单词或词组会被自动、确定性地分类到 “绿色” 或 “红色” 列表中拥有密钥的人可确定单词分类没有密钥的人则无法做到。文本中的单词越多越能准确分析出该文本是否由特定的 AI 模型生成。作者对这项技术提出质疑认为没有两个同义词的含义是完全相同的写作时选择的具体词汇至关重要希望 LLM 在每个决策点都能选择最恰当、最精确的词汇。Anthropic 要对生成的所有超过 200 个标记的文本进行篡改即便用户与 Claude 之间的私人对话也不例外这会让情况变得更糟。促使这一切发生的欧盟相关规定被作者认为是官僚主义的空想废话。遵守该规定只会给诚实的用户带来麻烦不诚实的用户可轻易绕过检测。James Padolsey 也解释了这一点他开发的 Declaude 可去除文本标记说明欧盟这项规定考虑不周全。Google 有一个名为 SynthID 的水印系统可应用于 AI 生成的文本。其描述与声称的 “人眼无法察觉” 自相矛盾揭示了该方案对生成文本的扭曲。Google 团队的实验结论也受到作者质疑认为点赞和点踩按钮不是评估质量影响的好方法“人类评价的回复质量和实用性差异可以忽略不计” 并不意味着 “无法察觉”Gemini 质量落后可能与使用 SynthID 有关。回到 Anthropic 发布的文章其声称的水印方法不会影响输出质量、读者无法区分带水印和不带水印的文本等内容被作者认为是 “具体词汇不重要没人会仔细阅读内容”。作者认为水印必然会使文本变差且只有 Anthropic 能检查文本是否由 Claude 生成。Claude 校对人类撰写的文本时可能会因水印问题让文章被标记为 Claude 生成。Anthropic 重视编程代码的精确性但不重视散文的精确性。Anthropic 实施水印是为了遵守欧盟的 AI 法案但该公司距离 IPO 只有几周时间预计估值达 2 万亿美元这让人思考其是否有能力仅在欧盟范围内遵守法律以及若其他市场将 AI 对生成文本进行秘密水印标记定为非法会怎样。OpenAI 在支持文档中提到目标是将来源信号扩展到包括文本在内的所有形式但这句话解释空间大作者认为应明确表态除非用户主动要求否则 ChatGPT 不会对生成的文本添加水印。最后作者列出 arXiv 上的三篇论文还引用了 Michael Lopp 和 Jeff Gamet 的观点指出水印是 “毒药”因为只有 Anthropic 持有密钥会让人们心存疑虑担心内容被无端指责为 AI 生成。