Google a ouvert son détecteur SynthID à tout le monde. Lisez les petits caractères.

Google a ouvert son détecteur SynthID au public le 7 octobre, permettant à quiconque de vérifier si une image, une vidéo ou un fichier audio contient un filigrane IA caché. Le portail à l’adresse synthid.com est accessible dans le monde entier en anglais. Connectez-vous avec un compte Google, OpenAI ou Apple et téléversez un fichier.
Il s’agit d’une véritable amélioration par rapport à la situation précédente, où le seul moyen de vérifier la présence de SynthID en dehors du programme de testeurs de confiance de Google consistait à demander à Gemini et à interpréter sa réponse. Détecter des filigranes ne devrait pas nécessiter une conversation avec le modèle qui les a appliqués. Jusqu’à cette semaine, le détecteur était réservé à un groupe de test composé de journalistes, de professionnels des médias et de chercheurs ayant obtenu l’accès à Google I/O l’an dernier, et la réponse arrivait souvent sous forme d’un paragraphe de prose alors que ce que l’on voulait était un seul bit.
À quoi ressemble le passage à l’échelle
Les chiffres derrière SynthID sont colossaux. Depuis son lancement en 2023, Google affirme avoir apposé un filigrane sur plus de 180 milliards d’images et de vidéos, ainsi que 240 000 années de contenu audio. Les vérifications menées dans Search, l’application Gemini et Chrome traitent désormais plus d’un million de requêtes par jour.
Le mécanisme est la partie intéressante. SynthID intègre un signal directement dans les pixels d’une image ou d’une vidéo, et dans les composantes fréquentielles de l’audio, plutôt que dans des métadonnées qui peuvent être supprimées. Pour les images et les vidéos, le filigrane est inscrit au moment de la création et conçu pour survivre au recadrage, aux filtres, aux changements de fréquence d’images et à la compression avec perte. Pour l’audio, il est conçu pour résister au bruit ajouté, à la compression MP3 et aux changements de vitesse de lecture. Le filigrane textuel de l’application Gemini fonctionne différemment : il ajuste les scores de probabilité que le modèle attribue aux mots candidats afin que la sortie visible reste inchangée.
Cette différence dans l’emplacement du signal explique pourquoi SynthID survit à des opérations qui suppriment purement et simplement les métadonnées. Une capture d’écran, un réencodage et un nettoyage des métadonnées supprimeront toutes les balises de provenance, mais ils ne suppriment pas un motif tissé dans les valeurs de pixels elles-mêmes. La contrepartie est que le signal au niveau des pixels est aussi celui qui risque le plus de se dégrader sous une transformation agressive, ce qui explique pourquoi le détecteur demande le fichier de la plus haute qualité dont vous disposez.
Les formats pris en charge sont nombreux : JPG, PNG, WEBP, HEIC et plusieurs autres types d’images ; MP4, MOV et WEBM pour la vidéo ; WAV, MP3, OGG, FLAC, AAC et M4A pour l’audio.
Le partenariat est la véritable expansion
Auparavant, le détecteur ne vérifiait que le SynthID de Google. Les images ChatGPT portaient aussi SynthID, et l’outil de Google ne les signalait pas. Cette limitation a disparu. Le détecteur prend désormais en charge les filigranes de tous les partenaires SynthID, notamment OpenAI, NVIDIA et Kakao, Apple devant rejoindre le groupe bientôt.
L’effet pratique est qu’un seul téléversement peut identifier la sortie de plusieurs grands fournisseurs au lieu d’exiger une vérification distincte sur la page de vérification de chaque entreprise. OpenAI conserve sa propre page, donc une image soupçonnée de provenir de ChatGPT a deux endroits où être vérifiée.
Les limites méritent la même importance
Le site précise explicitement qu’il ne s’agit pas d’un détecteur d’IA général, et l’avertissement compte davantage que la fonctionnalité. Il ne peut identifier que les médias provenant d’entreprises ayant adopté SynthID. Microsoft et Meta appliquent leurs propres normes de filigrane et de vérification, et ni l’une ni l’autre ne figure sur la liste des partenaires. Le détecteur de Meta a déjà été pris en défaut sur certaines de ses propres images d’IA recadrées.
Vient ensuite le problème des modèles à poids ouverts. N’importe qui peut exécuter un modèle ouvert sur son propre matériel et produire un résultat sans aucun filigrane ni étiquetage de métadonnées. Ce contenu n’apparaîtra jamais dans le détecteur.
Un résultat négatif signifie donc que l’origine du fichier est inconnue. Cela ne veut pas dire que le fichier est authentique. Il peut provenir d’un modèle extérieur au réseau de partenaires, ou une modification importante peut avoir dégradé le signal au point de le rendre indétectable. Les recommandations du site lui-même sont de téléverser la version de la plus haute qualité disponible et de rassembler plusieurs points de données avant de tirer une conclusion.
Le site signale aussi le mode de défaillance opposé, qui attire moins l’attention. Dans de rares cas, le détecteur peut se déclencher à tort sur du contenu qui ne porte aucun filigrane. Un faux positif est une erreur plus dommageable qu’un faux négatif, car il invite quelqu’un à accuser une vraie photographie d’être synthétique. Les erreurs existent dans les deux sens, et ni l’une ni l’autre ne remplace la vérification de la provenance d’un fichier.
L’accès est délibérément limité
L’outil est gratuit mais soumis à conditions d’accès. Les utilisateurs disposent d’un quota quotidien d’environ 10 vérifications d’images, de vidéos et d’audio, et doivent être connectés. Des ingénieurs de Google ont déclaré que cette limite existe pour empêcher que les vérifications servent à développer des outils de suppression de SynthID. Le chiffre du quota est décrit de façon approximative, car le système peut vous bloquer plus tôt si vous vérifiez de nombreux fichiers très similaires. Ce schéma ressemble à quelqu’un qui met au point un contournement.
Les médias téléversés sont traités en temps réel et supprimés après le retour des résultats, selon l’avis de confidentialité, bien qu’une signature numérique du fichier soit conservée pendant 24 heures pour faire respecter les quotas. Les conditions interdisent la rétro-ingénierie de la logique de détection, l’automatisation des requêtes et la création de plusieurs comptes pour contourner les limites.
Deux philosophies de la provenance
SynthID est un filigrane proactif : étiqueter le contenu IA. L’approche alternative consiste à étiqueter plutôt le contenu authentique, en utilisant des normes cryptographiques comme C2PA pour inscrire par signature des informations de provenance dans les fichiers au moment de la capture. Les téléphones Pixel de Google sont parmi les rares appareils à le faire.
Les deux approches échouent de manières différentes. Le filigrane dépend de la coopération du générateur, ce que les modèles à poids ouverts n’ont aucun intérêt à faire. La signature cryptographique dépend de la coopération de l’appareil de capture, ce qui la limite aux matériels qui intègrent cette capacité. Aucune des deux ne couvre à elle seule l’ensemble du problème, et le conseil pratique est d’utiliser les deux, parallèlement au travail peu glamour consistant à vérifier la source, la date et le contexte.
Il y a une raison structurelle pour laquelle l’approche par filigrane est celle qui a été déployée en premier. Elle n’exige aucun nouveau matériel et aucun changement dans la façon dont le contenu est consommé. Elle peut être ajoutée aux modèles existants par une mise à jour. La provenance cryptographique nécessite un écosystème d’appareils de capture, d’outils d’édition et de visionneuses qui s’accordent tous sur une norme, et cet écosystème reste encore largement aspirationnel. Le chemin le plus facile a été construit en premier, et le chemin le plus facile a l’angle mort le plus large.
Se pose ensuite la question adversariale pour laquelle personne n’a de bonne réponse. Les filigranes sont conçus pour être durables, ce qui n’est pas la même chose qu’impossible à supprimer. Chaque outil public de détection fournit un signal d’entraînement à quiconque cherche à le déjouer, et c’est précisément pourquoi Google plafonne le quota et interdit les requêtes automatisées. Le détecteur est utile, et le détecteur est aussi une carte pour ceux qui cherchent à effacer la marque.
Ce qu’il faut retenir
Le modèle mental utile est que SynthID vous donne un « oui » fort et un « non » très faible. Une correspondance positive pointe vers un ensemble spécifique de fournisseurs. Une correspondance négative ne vous dit presque rien. Quiconque considère cette dernière comme un certificat de bonne santé utilise mal l’outil, et la documentation de Google est inhabituellement franche à ce sujet.
Un accès plus large à la détection est une véritable avancée pour l’éducation aux médias. Le gain est plus étroit que l’annonce ne le laisse entendre, et c’est dans les mises en garde que réside l’utilité réelle.
Articles associés
La puce mémoire est désormais le goulot d'étranglement du calcul IA
La feuille de route de la logique est publique et prévisible. La feuille de route de la mémoire est conditionnée par les rendements d'assemblage, une base de compétences qui se construit sur des années et les plans d'investissement de trois entreprises.
La musique IA a obtenu une licence. Voici ce qu’elle couvre réellement.
Les morceaux bon marché existent toujours. Ce qui disparaît, c’est l’hypothèse qu’un morceau généré à partir d’un prompt est exempt de revendications, ce qui n’a jamais été vrai et est désormais manifestement faux.
Les studios de Hengdian sont vides tandis que le pipeline de films IA d'Asie tourne à plein
Les plateaux vides de Hengdian sont la preuve que l'industrie a déjà posé son pari, que le public soit d'accord ou non.
Google achète 890 mégawatts de nucléaire pour alimenter ses centres de données
La puissance de calcul est disponible. L'électricité est ce qui doit être organisé, des années à l'avance, comme on organise une chaîne d'approvisionnement.