谷歌把「看看这张图是不是 AI 生成的」做成了一个网站

10 月 7 日,Google 把 SynthID Detector 搬上了公网。地址很短,synthid.com,登录之后就能把一张图、一段视频或者一段音频拖进去,几秒钟后它会告诉你:检测到水印,或者没检测到。
过去这事只能求 Gemini 帮忙。你上传文件,然后看模型用一段自然语言描述它看到了什么,想要一个干脆的「是」或「否」很费劲。现在 Google 把判断单独拆出来,做成一个只需要登录、不需要理解模型话术的入口。
1800 亿张图,和 24 万年的音频
SynthID 不是新东西。Google 在 2023 年就把它用在自己的生成模型上,做法是把一段人眼看不见、人耳听不到的信号直接编进像素和音频波形里,而不是塞进可以被一键清空的元数据。这一点很重要:元数据像贴在画框背后的便签,复制粘贴、截图、转存之后往往就没了,而写进像素的信号会跟着画面一起被带走。按 Google 公布的数字,从 2023 年上线至今,它标记过超过 1800 亿张图片和视频,外加相当于 24 万年的音频内容。音频那部分的量级听起来夸张,其实是把 Lyria 音乐生成和 NotebookLM 播客功能产出的全部内容都算了进去。
水印本身也做了抗改造的处理。按 Google DeepMind 的技术说明,图片和视频的水印在生成的那一刻就被写入,经历裁切、加滤镜、改帧率、有损压缩之后仍然有较大概率被检出;音频水印则针对噪声叠加、MP3 压缩和变速播放做了加固。Gemini 生成的文本走的是另一条路,通过微调模型对每个候选词的打分分布来埋信号,肉眼看到的文字完全没有变化。
这次开放的关键变化在合作方。以前的检测器只认 Google 自家的水印,一张由 ChatGPT 生成的图片即使也带了 SynthID,在 Google 的工具里照样不会被标记出来。现在这个限制取消了,检测器同时支持 OpenAI、NVIDIA、韩国的 Kakao,Apple 也答应随后加入。
换算下来,一次上传就能同时核对好几家公司的生成痕迹,不用再挨个去各家自己的验证页面。Google 顺带把这项能力接进了搜索、Gemini 应用和 Chrome,这三处合计每天要处理超过 100 万次核验请求。
为什么不让你无限次查
工具本身免费,但有限制。每个账号每天大约只有 10 次图片、视频、音频的检查额度,而且要登录 Google、OpenAI 或 Apple 账号才能用。Google 的工程师解释过原因:限制访问是为了防止有人拿检测结果去反向训练一个「去水印」的工具。额度数字故意说得模糊,如果你连续上传一堆非常相似的图片,系统可能更早把你锁住,因为这看起来像是在试探某种绕过方案。
还有一个细节值得留意。上传的文件会被实时处理,出结果后立刻删除,但文件的数字签名会保留 24 小时,用来统计当天的配额。
「没检测到」不等于「不是 AI 生成的」
这是整个工具最需要说清楚的地方,Google 自己在常见问题里也写了:这不是一个通用的 AI 检测器。它只能识别采用了 SynthID 技术的公司所产出的内容。
现实里有大量内容天然落在它的判断范围之外。微软和 Meta 走的是各自的水印标准,两家都不在 Google 的合作名单上;Meta 今年还出过一次自己的检测器漏掉自家裁切过的 AI 图片的情况。更关键的是开放权重模型,任何人都能在自己的机器上跑,生成的内容连最基本的元数据标记都没有。
所以「未检测到水印」的正确读法是「来源未知」,而不是「这是真的」。文件可能来自一个没接入 SynthID 的模型,也可能只是被裁切、压缩、翻录得太厉害,把信号磨掉了。
Google 的另一种思路刚好相反:与其给 AI 内容打标,不如给真实内容打标。C2PA 这类密码学手段是在拍摄设备上就把来源信息签进去,Pixel 手机是少数已经在这么做的产品。一个往假的内容上贴标签,一个往真的内容上贴标签,两条路各管一头。
对普通使用者来说,这个网站的实际价值在于它是一个统一入口。看到一张可疑的图,先丢进去查一次,再结合来源、时间、上下文去判断,比单看结果靠得住。值得注意的是它支持的格式相当宽:图片涵盖 JPG、PNG、WEBP、HEIC,视频覆盖 MP4、MOV、WEBM,音频则包括 WAV、MP3、FLAC 等常见类型,日常遇到的绝大多数文件都能直接上传。
中文语境里,这半年关于「这张图是不是 AI 画的」的争论一直没停,图库网站的成片和手机上刷到的插画越来越难分辨。多一个能查的地方总是好事,前提是别把它当成判决书。真正需要建立的判断习惯是:水印检测给出的是一个单点信号,它说「有」的时候可信度较高,说「没有」的时候几乎什么都没说。一张图是否可信,最终还是要看拍摄或生成它的人是谁、在什么场合发布、有没有第二方能够佐证。工具能帮你排除掉一部分,但不能帮你下结论。
