1500万欧元的代价:Claude这次给每个字都盖了个"隐形章",但普通人先躺枪了

4次阅读

你用Claude改了一个错别字,结果这段文字被打上了"AI写的"印记。

这事听起来有点魔幻,但它就发生在最近。Anthropic在8月13日宣布,从今往后,所有新版本Claude生成的每一个字、每一段代码、甚至帮你翻译的一句话,统统要盖一个看不见的"章"。

理由听上去很正当:欧盟AI法案要来了,违规罚款最高1500万欧元,或者全球年营收的3%。Anthropic的解决办法是——把章盖得彻底一点,连法案明说不用盖的"小修改"也一起盖。

这一盖,盖出了大问题。

这章是怎么"盖"的

Anthropic用的是Google DeepMind在2024年发表在《Nature》上的SynthID-Text技术。原理不复杂:你写"今天天气很冷,可能……",下一个词模型可以选"下雪"、"阴天"、"刮风",这些词选哪个其实都通。Watermark干的事就是——在所有"差不多都行"的词里,挑出能让整篇文章留下隐藏密码的那一个。

读的人完全看不出来。但只要拿着对应的"钥匙",就能反推"这段八成是Claude写的"。

Anthropic自己的测试说,加水印不影响质量、速度、价钱。听起来很完美,对吧?

问题是:水印只在"差不多都行"的地方有用。

比如"牛顿最著名的著作叫《自然哲学的数学原理》",下一个词几乎只能选"Mathematica",没得选。这种地方水印盖不上。再比如代码里"2+2="后面只能写"4",水印也盖不上。

但反过来——如果你只是让Claude帮你改了一个逗号,那基本每个词都是你原来写的,水印稀稀拉拉盖不上去。

更尴尬的是中间地带:你让Claude"帮我润色一下"、"翻译一下"、"总结一下",水印就会乖乖地盖上去。

Anthropic这次"用力过猛"

欧盟AI法案其实是有豁免的。法律写得明明白白:

"如果AI只是帮你做个语法纠错、辅助编辑,没改内容、没改意思——这种可以不打标。"

Anthropic自己也承认这件事。它在官网上写:"人们经常用Claude做校对、翻译、总结、转文件。即使想法、文字、数据是用户自己的,输出也可能被打标。"

明知豁免存在,依然全量打标。Ars Technica用了一个词形容这种做法——"nuke it from orbit",从轨道上炸掉它,意思是一刀切、不留活口。

Anthropic的逻辑是:水印这种东西,宁可错杀一千,不可放过一个。法律最低要求是A,我直接做到A+++,这样绝对合规。

听起来很安全。但现实是——

谁是第一个被冤枉的

一个学生用Claude检查了论文里的几个语法错误。提交的时候,老师拿工具一查,水印显示"AI touched this"。

老师会不会觉得这篇论文就是AI写的?

一个上班族用Claude把自己写的中文邮件翻译成英文发出去。对方公司用检测工具一查,水印飘红。"这邮件是不是AI写的?"

一个博主用Claude给自己的原创故事润色了一下,挂到网上。被读者拿检测工具扫到水印,评论区瞬间变成"AI生成"质疑。

Anthropic自己的话是这么说的:水印信号不是"铁证",它只是告诉你"这段内容可能经过Claude之手"。但普通用户、老师、HR、编辑会这么理性吗?

当一个信号被普遍理解为"AI写的",它的原意就已经不重要了。重要的是大家怎么用它。

更尴尬的是:坏人几乎不受影响

真正想用AI作弊的人,有100种方法绕过水印。

最简单的一种:把Claude写的内容复制粘贴到ChatGPT、Gemini、DeepSeek、文心一言里,让另一个AI重写一遍。水印就没了。

复杂一点的方法:让Claude用代码写一段话,输出代码不强制水印。再把代码逻辑"反编译"成自然语言。水印照样消失。

图像和视频更简单——C2PA元数据水印?截个图、用PS删几个字段,30秒搞定。

Anthropic自己也写了:"watermarks will travel with the text when it's copied and pasted elsewhere, and may persist through some editing. But if watermarked text is pasted into another chatbot system that edits the text, the watermark could be destroyed."

翻译成人话:水印在复制粘贴时能存活,但只要经过别的AI编辑一下,就死透了。

结果就是:守规矩的普通用户被打标,想作弊的黑产完全无感。

罚款1500万欧元,是为了打谁?

欧盟AI法案50(4)条说得很清楚:AI完全生成的文本,比如一本AI写的小说、一段AI写的营销文案,在大多数情况下根本不需要打标。只有当内容涉及"公共利益议题"时(比如新闻、科普、政策解读),才强制要求标注。

这意思是:法律真正想管的是"AI伪装成人写的来误导公众",不是"AI帮你改个错字"。

Anthropic把水印打到所有内容上,等于把所有用户都拖进了"AI嫌疑"的池子里。但真正会被罚的,是那些用AI写假新闻误导公众的人。而这些人,根本不会用带水印的Claude,他们会用别的渠道。

罚款1500万欧元的法律,最后罚的不是坏人,是守规矩的人被冤枉时无法自证清白的代价。

留给普通人的3个现实问题

(1) 你用Claude修改的任何文字,将来都可能被误判为"AI写的"。律师函、学术审查、雇主调查、内容平台审核,水印就是第一道有罪推定。

(2) 你以为"我没让AI写,我只是改了几个词"是护身符,但Anthropic已经明确——这种场景也会被打标。

(3) 你想证明"这是我写的"?目前Anthropic没公布任何检测工具,没公布误报率,没公布反查机制。也就是说,普通人被冤枉了,连申诉的入口都没有。

AI治理的下一步

Anthropic不是第一家这么干的。Google的Gemini已经在用类似的SynthID技术打标。OpenAI据说也在做。

整个行业的共识是:水印是合规成本最低的方案。用户用不用、AI理解不理解,是另一回事。

真正应该做的,是把"AI写"和"AI改"区分开。前者可能误导公众,后者只是工具使用。但在技术实现上,区分这两件事非常难。所以大家干脆一刀切——全盖。

技术不够精细的时候,监管和合规就会用最笨的办法兜底。然后普通人跟着一起兜底。

你下次用Claude的时候,记住一件事:

那个看不见的章,已经替你盖上了。

至于是保护你还是冤枉你,取决于谁先看到它。

正文完
 0