← Retour au blog
AiEnviron 7 min de lecture

Google transforme « cette image est-elle générée par IA ? » en un site web

Publié le 7 oct. 2026
Google transforme « cette image est-elle générée par IA ? » en un site web

Le 7 octobre, Google a mis SynthID Detector en ligne sur le Web public. L’adresse est très courte, synthid.com : après s’être connecté, il suffit d’y glisser une image, une vidéo ou un fichier audio et, en quelques secondes, l’outil vous indique si un filigrane a été détecté ou non.

Auparavant, il fallait demander de l’aide à Gemini. On téléversait un fichier, puis on lisait la description en langage naturel de ce que le modèle avait vu ; obtenir un « oui » ou un « non » clair et net était laborieux. Aujourd’hui, Google a isolé cette évaluation et en a fait un point d’entrée qui ne demande qu’une connexion, sans avoir à comprendre le discours du modèle.

180 milliards d’images, et 240 000 ans d’audio

SynthID n’est pas une nouveauté. Google l’utilise sur ses propres modèles génératifs depuis 2023 : la méthode consiste à intégrer directement un signal invisible à l’œil nu et inaudible à l’oreille dans les pixels et les formes d’onde audio, plutôt que de le glisser dans des métadonnées effaçables d’un simple clic. Ce point est important : les métadonnées ressemblent à une note collée au dos d’un cadre, qui disparaît souvent après un copier-coller, une capture d’écran ou un enregistrement, tandis que le signal écrit dans les pixels suit l’image. Selon les chiffres publiés par Google, depuis son lancement en 2023, il a marqué plus de 180 milliards d’images et de vidéos, plus l’équivalent de 240 000 ans de contenu audio. L’ordre de grandeur de la partie audio peut sembler exagéré, mais il inclut la totalité des contenus produits par la génération musicale Lyria et la fonction de podcasts de NotebookLM.

Le filigrane lui-même est également conçu pour résister aux modifications. D’après les explications techniques de Google DeepMind, les filigranes des images et des vidéos sont inscrits au moment même de la génération et restent détectables avec une probabilité relativement élevée après recadrage, ajout de filtres, modification de la fréquence d’images ou compression avec perte ; les filigranes audio sont renforcés contre l’ajout de bruit, la compression MP3 et la lecture à vitesse modifiée. Les textes générés par Gemini suivent une autre voie : le signal est enfoui en ajustant finement la distribution des scores attribués à chaque mot candidat, sans que le texte visible change d’un iota.

Le changement clé de cette ouverture réside dans les partenaires. Auparavant, le détecteur ne reconnaissait que les filigranes de Google ; une image générée par ChatGPT, même si elle portait aussi un SynthID, n’était pas signalée dans l’outil de Google. Cette limite est désormais levée : le détecteur prend en charge OpenAI, NVIDIA et le sud-coréen Kakao, et Apple a promis de rejoindre le projet par la suite.

Concrètement, un seul téléversement permet de vérifier simultanément les traces de génération de plusieurs entreprises, sans avoir à passer successivement par les pages de vérification de chacune. Google a aussi intégré cette capacité à la recherche, à l’application Gemini et à Chrome ; ces trois espaces traitent ensemble plus d’un million de demandes de vérification par jour.

Pourquoi les vérifications ne sont pas illimitées

L’outil est gratuit, mais soumis à des limites. Chaque compte dispose d’environ 10 vérifications d’images, de vidéos et d’audio par jour, et il faut se connecter avec un compte Google, OpenAI ou Apple pour l’utiliser. Des ingénieurs de Google ont expliqué la raison : limiter l’accès vise à empêcher que quelqu’un utilise les résultats de détection pour entraîner en sens inverse un outil de « suppression de filigrane ». Le chiffre du quota est volontairement flou : si vous téléversez à la suite une série d’images très similaires, le système peut vous bloquer plus tôt, car cela ressemble à une tentative de contournement.

Un autre détail mérite l’attention. Les fichiers téléversés sont traités en temps réel et supprimés immédiatement après l’obtention du résultat, mais leur signature numérique est conservée pendant 24 heures, afin de comptabiliser le quota du jour.

« Aucun filigrane détecté » ne signifie pas « pas généré par IA »

C’est le point le plus important à clarifier concernant cet outil, et Google l’écrit lui-même dans sa FAQ : il ne s’agit pas d’un détecteur d’IA universel. Il ne peut identifier que les contenus produits par des entreprises ayant adopté la technologie SynthID.

Dans la réalité, une grande quantité de contenus échappe naturellement à son champ d’analyse. Microsoft et Meta suivent leurs propres normes de filigrane, et aucune des deux ne figure sur la liste de partenaires de Google ; Meta a d’ailleurs connu cette année un cas où son propre détecteur avait manqué des images IA recadrées par ses propres soins. Plus important encore, les modèles à poids ouverts peuvent être exécutés par n’importe qui sur sa propre machine, et les contenus générés ne comportent même pas le moindre marquage de métadonnées.

Ainsi, « aucun filigrane détecté » doit se lire « source inconnue », et non « ceci est authentique ». Le fichier peut provenir d’un modèle non intégré à SynthID, ou bien avoir été tellement recadré, compressé ou réenregistré que le signal a été effacé.

Google explore aussi une approche inverse : plutôt que de marquer les contenus IA, marquer les contenus authentiques. Des méthodes cryptographiques comme C2PA signent les informations de provenance directement sur l’appareil de prise de vue, et les téléphones Pixel sont l’un des rares produits à le faire déjà. L’une appose une étiquette sur les contenus faux, l’autre sur les contenus vrais : deux voies qui couvrent chacune une extrémité.

Pour l’utilisateur ordinaire, la valeur pratique de ce site réside dans son rôle de point d’entrée unique. En voyant une image suspecte, mieux vaut la soumettre d’abord à une vérification, puis juger en tenant compte de la source, de la date et du contexte : c’est plus fiable que de se fier au seul résultat. À noter qu’il prend en charge un large éventail de formats : les images incluent JPG, PNG, WEBP et HEIC, les vidéos couvrent MP4, MOV et WEBM, et l’audio comprend des types courants tels que WAV, MP3 et FLAC ; la grande majorité des fichiers rencontrés au quotidien peuvent donc être téléversés directement.

Dans le contexte chinois, le débat sur « cette image est-elle dessinée par IA ? » n’a pas cessé depuis six mois, et il devient de plus en plus difficile de distinguer les photos finalisées des banques d’images des illustrations vues sur téléphone. Disposer d’un endroit supplémentaire où vérifier est toujours une bonne chose, à condition de ne pas le prendre pour un verdict. L’habitude de jugement à vraiment acquérir est la suivante : la détection de filigrane ne fournit qu’un signal ponctuel ; lorsqu’elle dit « oui », sa fiabilité est élevée, mais lorsqu’elle dit « non », elle ne dit presque rien. Pour savoir si une image est crédible, il faut en fin de compte regarder qui l’a prise ou générée, dans quel contexte elle a été publiée et si une tierce partie peut la corroborer. L’outil peut vous aider à écarter une partie des cas, mais il ne peut pas tirer de conclusion à votre place.

Coupe nette d’un prisme de verre sur une dalle de pierre sombre, un unique faisceau blanc s’épanouissant en un doux spectre qui se fond dans l’obscurité

Articles associés