Google abrió su detector SynthID a todo el mundo. Lea la letra pequeña.

Google abrió su detector SynthID al público el 7 de octubre, permitiendo a cualquiera comprobar si una imagen, un vídeo o un archivo de audio contiene una marca de agua de IA oculta. El portal en synthid.com está activo a nivel mundial en inglés. Inicie sesión con una cuenta de Google, OpenAI o Apple y suba un archivo.
Esta es una mejora genuina respecto a la situación anterior, cuando la única forma de comprobar SynthID fuera del programa de probadores de confianza de Google era preguntar a Gemini e interpretar lo que respondiera. Detectar marcas de agua no debería requerir una conversación con el modelo que las aplicó. Hasta esta semana, el detector estaba en manos de un grupo de prueba de periodistas, profesionales de los medios e investigadores que obtuvieron acceso en el Google I/O del año pasado, y la respuesta a menudo llegaba en forma de párrafo de prosa cuando lo que uno quería era un solo bit.
Cómo se ve el escalado
Las cifras que respaldan SynthID son enormes. Desde su lanzamiento en 2023, Google afirma haber marcado con marca de agua más de 180.000 millones de imágenes y vídeos, además de 240.000 años de contenido de audio. Las verificaciones realizadas en Search, la aplicación Gemini y Chrome ahora gestionan más de un millón de solicitudes diarias.
El mecanismo es la parte interesante. SynthID incrusta una señal directamente en los píxeles de una imagen o un vídeo, y en los componentes de frecuencia del audio, en lugar de en metadatos que pueden eliminarse. En imágenes y vídeo, la marca de agua se escribe en el momento de la creación y está diseñada para sobrevivir a recortes, filtros, cambios de velocidad de fotogramas y compresión con pérdida. En audio, está construida para resistir ruido añadido, compresión MP3 y cambios de velocidad de reproducción. El marcado de agua de texto de la aplicación Gemini funciona de forma distinta: ajusta las puntuaciones de probabilidad que el modelo asigna a las palabras candidatas para que la salida visible no cambie.
Esa diferencia en dónde reside la señal es la razón por la que SynthID sobrevive a operaciones que eliminan los metadatos por completo. Una captura de pantalla, una recodificación y un borrado de metadatos eliminarán las etiquetas de procedencia, pero no eliminan un patrón entretejido en los propios valores de los píxeles. La contrapartida es que la señal a nivel de píxel es también la que más probabilidades tiene de degradarse bajo transformaciones agresivas, por lo que el detector pide el archivo de mayor calidad que tenga.
Los formatos compatibles son amplios: JPG, PNG, WEBP, HEIC y otros varios tipos de imagen; MP4, MOV y WEBM para vídeo; WAV, MP3, OGG, FLAC, AAC y M4A para audio.
La alianza es la verdadera expansión
Antes, el detector solo comprobaba el SynthID de Google. Las imágenes de ChatGPT también llevaban SynthID, y la herramienta de Google no las señalaba. Esa limitación ha desaparecido. El detector ahora admite marcas de agua de todos los socios de SynthID, incluidos OpenAI, NVIDIA y Kakao, y Apple se unirá pronto.
El efecto práctico es que una sola carga puede identificar resultados de varios proveedores importantes en lugar de requerir una comprobación por separado en la página de verificación de cada empresa. OpenAI aún mantiene su propia página, así que una imagen sospechosa de ChatGPT tiene dos lugares donde consultarse.
Los límites merecen la misma atención
El sitio es explícito en que no es un detector de IA general, y el descargo de responsabilidad importa más que la función. Solo puede identificar contenido multimedia de empresas que hayan adoptado SynthID. Microsoft y Meta tienen sus propios estándares de marcado de agua y verificación, y ninguno de los dos aparece en la lista de socios. El detector de Meta ya ha sido sorprendido omitiendo algunas de sus propias imágenes de IA recortadas.
Luego está el problema de los modelos de pesos abiertos. Cualquiera puede ejecutar un modelo abierto en su propio hardware y producir resultados sin marca de agua y sin ningún etiquetado de metadatos. Ese contenido nunca aparecerá en el detector.
Un resultado negativo, por tanto, significa que el origen del archivo es desconocido. No significa que el archivo sea auténtico. Puede provenir de un modelo fuera de la red de socios, o una modificación intensa puede haber degradado la señal más allá de lo detectable. La propia guía del sitio es subir la versión de mayor calidad disponible y reunir múltiples puntos de datos antes de sacar una conclusión.
El sitio también señala el modo de fallo opuesto, que recibe menos atención. En casos raros, el detector puede activarse falsamente en contenido que no lleva ninguna marca de agua. Un falso positivo es un error más dañino que un falso negativo, porque invita a alguien a acusar a una fotografía real de ser sintética. Existen errores en ambas direcciones, y ninguno sustituye a comprobar de dónde vino un archivo.
El acceso está deliberadamente limitado
La herramienta es gratuita pero restringida. Los usuarios tienen una cuota diaria de aproximadamente 10 comprobaciones de imagen, vídeo y audio, y deben haber iniciado sesión. Los ingenieros de Google han dicho que el límite existe para impedir que la gente use las comprobaciones para desarrollar herramientas de eliminación de SynthID. La cifra de la cuota se describe de forma vaga porque el sistema puede bloquearle antes si comprueba muchos archivos muy similares. Ese patrón se parece a alguien ajustando un método de elusión.
Según el aviso de privacidad, el contenido multimedia subido se procesa en tiempo real y se elimina después de devolver los resultados, aunque se conserva una firma digital del archivo durante 24 horas para hacer cumplir las cuotas. Los términos prohíben la ingeniería inversa de la lógica de detección, la automatización de consultas y la creación de múltiples cuentas para eludir los límites.
Dos filosofías de la procedencia
SynthID es marcado de agua proactivo: etiquetar el contenido de IA. El enfoque alternativo es etiquetar el contenido auténtico en su lugar, usando estándares criptográficos como C2PA para firmar información de procedencia en los archivos en el momento de la captura. Los teléfonos Pixel de Google están entre los pocos dispositivos que hacen esto.
Los dos enfoques fallan de maneras distintas. El marcado de agua depende de que el generador coopere, algo que los modelos de pesos abiertos no tienen incentivo para hacer. La firma criptográfica depende de que el dispositivo de captura coopere, lo que la limita al hardware que incluye esa capacidad. Ninguno cubre todo el problema por sí solo, y el consejo práctico es usar ambos, junto con el poco glamuroso trabajo de comprobar la fuente, la fecha y el contexto.
Hay una razón estructural por la que el enfoque del marcado de agua fue el primero en llegar. No requiere hardware nuevo ni cambios en cómo se consume el contenido. Se puede adaptar a los modelos existentes con una actualización. La procedencia criptográfica requiere un ecosistema de dispositivos de captura, herramientas de edición y visores que coincidan en un estándar, y ese ecosistema sigue siendo en gran medida aspiracional. El camino más fácil se construyó primero, y el camino más fácil tiene el mayor punto ciego.
Luego está la cuestión adversaria para la que nadie tiene una buena respuesta. Las marcas de agua están diseñadas para ser duraderas, lo que no es lo mismo que ser irremovibles. Toda herramienta pública de detección proporciona una señal de entrenamiento para cualquiera que intente derrotarla, que es precisamente por lo que Google limita la cuota y prohíbe las consultas automatizadas. El detector es útil y el detector también es un mapa para quienes intentan borrar la marca.
Qué llevarse
El modelo mental útil es que SynthID le da un «sí» contundente y un «no» muy débil. Una coincidencia positiva apunta hacia un conjunto específico de proveedores. Una coincidencia negativa no le dice casi nada. Quien trate esto último como un certificado de buena salud está usando la herramienta incorrectamente, y la propia documentación de Google es inusualmente sincera al respecto.
Un acceso más amplio a la detección es una verdadera victoria para la alfabetización mediática. La victoria es más limitada de lo que sugiere el anuncio, y las advertencias son donde reside la utilidad real.
Artículos relacionados
El chip de memoria es ahora el cuello de botella del cómputo de IA
La hoja de ruta de la lógica es pública y predecible. La de la memoria está condicionada por los rendimientos de empaquetado, una base de talento que se tarda años en formar y los planes de inversión de tres empresas.
La música con IA obtuvo una licencia. Lee qué cubre en realidad.
Las pistas baratas siguen existiendo. Lo que está desapareciendo es la suposición de que una pista generada a partir de un prompt está libre de reclamaciones, algo que nunca fue cierto y que ahora es demostrablemente falso.
Los estudios de Hengdian están vacíos mientras avanza la cadena de producción de cine con IA de Asia
Los platós vacíos de Hengdian son la prueba de que la industria ya ha hecho su apuesta, coincida o no el público.
Google compró 890 megavatios de energía nuclear para alimentar sus centros de datos
La capacidad de cómputo está disponible. La electricidad es lo que hay que organizar, con años de antelación, como se organiza una cadena de suministro.