AI资讯

Claude文本水印技术细节公开,你的助手成了Anthropic卧底?

智能摘要

就在刚刚,Anthropic发了一篇博客,首次公开解释了Claude文本水印的技术细节。Anthropic官博里有这么一句:水印只作用于Claude「选择」的词。越是精确表达,水印越没有发挥空间。Anthropic自己承认,水印只能判断Claude「可能参与过」,再细就分不了了。

标题

AI写的水印能被全世界查出来

正文

你写的文字,可能正在被悄悄标记。

AI助手不再是你的免费打工人,而是安插在你身边的卧底。

水印是怎么藏进去的

首先, 文字是以一词一词的形式蹦出来的, 在每次蹦词之前, 模型要算出一堆候选词, 并且每个候选词带有不同的概率, 那些意思相近的选项, 其概率往往是差不多的, 最终到底选哪个基本上要看随机数是怎么掷的。

动着的水印, 即为这个随机数,先前之时它并无规律, 任何人皆无法做出预测, 如今借助密钥计算得出一串具备规律的数将其替换, 持有密钥之人便能从文字当中验出此规律, 整个流程并不改变语句的通顺程度, 亦不生硬搬用冷僻字词。

和检测工具有什么不同

市面上存在的那些AI检测工具, 因没有密钥, 所以只能依靠猜测文风来进行检测, 而猜错这种情况在其中是处于常态的。当水印出现之后, 检测过程就无需再进行猜测了, 直接凭借密钥去验证即可, 如此一对比, 准确性方面呈现出截然不同的状况。

谷歌曾开展实测, 给一部分真实用户暗暗加上水印, 对比反馈之后, 点赞与点踩在统计方面不存在显著差异, 这表明用户几乎没办法察觉到变化, 水印偷偷地融入到日常对话当中了。

水印的局限性在哪

翻译乃水印效果最为强劲的场景, 当中每个英文词汇皆为挑选而出, 信号处于满负荷状态。然而代码的注释以及变量命名具备一定自由度, 核心逻辑所在位置需精准输出, 致使水印无法插入。短文本仅有一两百字, 可供选择的词汇过少, 水印亦难以留下较多痕迹。

仅仅是单纯的事实内容成为了死角, “牛顿最为著名的著作称作……”后续能够跟的仅仅是那唯一一个答案, 根本没有其他选择。校对的情况就更是尴尬至极了, 你写上三千字交给AI去修改二十来个地方, 然而百分之九十九的内容依旧是你自己所撰写的, 水印的作用几乎完全失效了。

四美分能擦掉一切

在2026年7月, 存在一项研究, 该研究是将带有水印的文本投入到特定的AI释义工具中进行改写, 其移除率竟然高到了98.3%, 其中, 五十九篇文本里有五十八篇在经过该工具处理跑完流程之后水印直接就消失不见了, 并且按照当前的定价来计算的话, 处理1篇千字文章仅仅只要四美分。

一旦检测API被公开, 矛盾将会进一步加深, 任何人都能够利用它进行反向优化, 更改一个词语后便运行一次检测, 直至水印信号降低到安全线以下, 在密码学领域中这称作逃避预言机, 而谷歌的检测API直至如今仍处于“即将推出”的状态。

圆珠笔不算共同作者

不会因你运用Word撰写文章便将Word列为共同作者, 水印也仅是需求一支圆珠笔宣称自身为作者的样子。一段文字一旦被追查至源头, 之后又如何继续推行? 一段文字即便被回溯起往昔经历往昔缘由, 至此后续又怎样延续进展? 之后又能否成功达成目标推进开展?

所有权是不会因水印发生改变的, 法律责任的归属同样如此, 不会因水印而改变。你的助手做了标记, 可这个标记无论如何也算, 证明不了你的罪责那般作用性上的存在, 也绝没有对你那清白可给予守护那般功效性上的实现。声称有幸并没有养成复制粘贴校对稿这么一种习性的硅谷博主, 表示起码是能够留存些许被掌握事态走向的主动权性质的情况的。

用过的人准备自证清白

只能凭借水印去判定“可能曾参与过”, 然而从起始去进行撰写还是大幅度修改, 根本就分辨不清, 这表明但凡使用过AI的人, 一概都需要备好自证自身清白的依据。

文字创作步入一个毫无藏身之地的时代, 你所留下的每一个字符都极有可能被标记起来。你思索一下未来究竟还会有多少内容能够被认定为真正是属于你自己的原创? 欢迎移步评论区去畅谈一番你的看法。

相关文章