尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

AI 水印落地了,代码却查不了

AI 水印落地了,代码却查不了 摘要欧盟 AI 法生效后Anthropic 给 Claude 输出加了文本水印与文件凭据还上线了免费检测页。能查的是图片音视频代码和纯文本恰恰不在清单里。本文拆这套机制也说说代码溯源为什么最难。9 月初Anthropic 上线了一个免费检测页把文件拖进去它会告诉你这个文件是不是被 Claude 处理过。文件不出本机凭据在浏览器里本地读取。程序员的第一反应多半是把手头的代码拖进去试试。页面弹回一句不支持。清单里是 JPG、PNG、SVG、MP4、WAV 这类图片音视频纯文本不在其中代码文件更不用说。这个落差就是本文想聊的内容溯源从口号变成了工具但证明代码是 AI 写的——这个很多人最想验证的场景——恰恰是最难落地的一环。为什么忽然全行业开始盖章先交代背景这不是厂商自发的善举是法律的 deadline。欧盟《人工智能法案》第 50 条在 2026 年 8 月 2 日生效要求生成式 AI 的提供者确保输出内容能以机器可读的方式被识别。7 月Anthropic 和另外约 190 家机构签署了欧盟的《AI 生成内容透明度实践准则》。Anthropic 选择全球部署而不是只给欧盟用户加。官方说明里给的理由很实在暂时没有可靠的办法按地区区分干脆一刀切。这跟当年 GDPR 的路径一样——一条欧盟法律最后变成一套全球默认。同行也在动OpenAI 5 月加入了 C2PA 联盟并与 Google 合作用 SynthID 给自己的图像输出打标官方说明见参考资料 1。两个信号机制完全不同Anthropic 实际交付的是两套独立机制经常被混为一谈。第一套是文本统计水印。Claude 生成文本时会依据一把检测密钥在语义等价的候选词之间做细微偏向形成人类看不出、但算法能复原的统计模式。它不是往文本里塞隐形字符是改变词的选择概率。这套水印覆盖面最广8 月 2 日之后发布的新模型Fable 5.1、Mythos 5.1在网页、API、Claude Code、Cowork 里生成的所有文本都带。经 AWS、Google Cloud、微软 Foundry 访问也一样。文本被复制粘贴后水印跟着走轻度编辑一般去不掉。代价在另一端完全改写、逐词替换能抹掉它。Anthropic 在 FAQ 里补了一句实话——被改写到这个程度还能不能算AI 生成本身就值得商榷。太短的文本也低于检测下限只有三五个词的回复统计上没有空间藏信号。第二套是文件凭据。Claude 生成的受支持文件目前是 PNG、JPG、SVG会在元数据里附一段加密签名的记录声明此文件由 Claude 制作或处理。它走的是 C2PA 开放标准——相机厂商和修图软件记录照片来源用的同一套联盟成员超过 6000 家组织。凭据和文本水印有个本质区别它不修改内容本体是挂在文件容器上的签名。好处是篡改可以被发现任何一个字节变了签名就断C2PA 读取工具会直接告诉你。坏处是它比水印脆弱得多截图、转码、换个软件另存容器重写一遍凭据就没了内容看起来毫无变化。检测器能查的和查不了的配套的免费工具叫 Content Checkerclaude.com/check-content。无登录拖文件即查支持 17 种图片、视频、音频格式上限 100MB全程本地处理——页面明确写文件不会上传工具说明见参考资料 2。它只读凭据不读内容。这句话值得细品。有评论直接点破了这款产品的诚实之处它明确告诉你只识别内容凭据不能判断 Claude 是否参与了创作。阳性结果说你被处理过阴性结果什么都不说明。这与过去三年的AI 检测器是两条路线。Pangram 这类工具没有厂商的密钥只能靠文本特征猜——最近它把 10 位英联邦文学奖得主中的 4 位误标成 AI。凭据路线不做猜测验的是签名是密码学校验不是推断。阳性 ≠ AI 写的。Claude 帮你润色一段话、校对一篇文章也算处理过凭据分不清生成和编辑。阴性 ≠ 人写的。反制工具开源的一抓一大把仅剥离 SynthID 和 C2PA 标记的工具就在 GitHub 上攒了 4900 多颗星截图、转码、重存这些日常操作也会随手丢掉凭据。无信号等于没有信息。代码为什么恰恰最难回到开头的落差。为什么证明代码是 AI 写的落在清单之外这里有三个层次。第一层最直接C2PA 凭据目前只挂在图片类文件上Content Checker 支持清单里没有纯文本格式。你把 .java、.py、.md 拖进去它根本没东西可读。机制上就够不着代码。第二层是检测权不公开。Claude Code 的文本输出理论上带统计水印——产品线全覆盖的口径里包含它。但检测这段水印需要 Detection API目前是私有预览只向监管机构、执法部门、媒体、事实核查组织这类欧盟法律点名的机构开放。个人开发者想自查没有门路。第三层是代码本身不适合统计水印这是我的判断官方没这么说。文本水印能工作前提是自然语言里同一个意思有海量的改写空间模型有足够自由度去做偏向。代码不一样语义等价的表达空间窄得多标识符能换结构变不了。更麻烦的是代码出厂前要过 formatter、lint、编译、重构——每一道都是对统计模式的破坏还是无心破坏。所以现状很清楚能可靠验证的是 AI 生成的富媒体资产——图片、音频、视频。至于这段代码是不是 AI 写的技术上仍停留在几个月前聊治理时说过的笨办法靠 commit 里的手动标记和流程约定。我的判断把期望摆正这套工具的价值才看得清。它是合作场景的工具不是对抗场景的武器。新闻室核验投稿图片、平台确认上传者主动附带的来源声明、企业自查合规——这些对方愿意配合溯源的场景凭据是可靠的。抓 AI 写的作业、查下属有没有用 AI 写代码——对方想藏的话截图、转码、剥离工具随手都是漏洞。官方把阴性结果不代表清白写在页面上本身就是承认了这条边界。对写代码的人来说今天它带来的直接价值很小。但有一个现在就能用的例外让 Claude 画架构图、生成设计稿这类资产导出的是 PNG、SVG——这些在支持清单里拖进检测页能验。代码本身查不了代码周边生成的图倒是能查这个反差本身就是现状的最好注脚。真正值得跟踪的是方向。欧盟把内容可溯源变成了模型出厂默认OpenAI、Google 在同一条路上跟进跨厂商的凭据互认正在成形。等代码工具哪天把这行代码怎么来的做成生成时默认附带的记录而不是事后靠人标记——证明代码是 AI 写的这个问题才算真正有解。在那之前再看到检测 AI 内容的按钮先看一眼它的支持清单。参考资料AnthropicHow Claude’s text watermarking works官方 FAQ更新于 2026-09-01https://www.anthropic.com/news/claude-text-watermarkGround TruthAnthropic shipped a content checker that cannot tell you if Claude wrote it2026-09https://groundtruth.day/news/anthropics-content-checker-cannot-tell-you-if-claude-wrote-it.htmlApidogHow Claude Marks AI-Generated Content?2026-09https://apidog.com/blog/how-claude-marks-ai-generated-contentLangProtectAnthropic’s AI Watermarks: What Enterprises Need to Know2026-09https://www.langprotect.com/blog/anthropic-ai-watermarks-enterprise-guide作者唐悦玮 | 从后端出发用 AI 拓展到全栈的工程师。
返回列表