ChatGPT vous habille désormais : les modèles d'image entrent dans le panier d'achat

OpenAI a déployé deux fonctionnalités d'achat cette semaine, et l'une d'elles constitue un message discret sur la direction que prend la génération d'images. ChatGPT peut désormais vous montrer à quoi ressemble un vêtement sur vous, à partir d'une photo que vous importez, et enregistrer les résultats à côté des articles que vous envisagez d'acheter.
La fonctionnalité se présente comme une cabine d'essayage plutôt qu'un générateur, et c'est précisément là que réside l'essentiel.
Comment ça marche
Demandez à ChatGPT des recommandations de vêtements : les articles éligibles affichent désormais un bouton « Essayer ». En appuyant dessus, il vous est demandé un selfie ou une photo en pied. ChatGPT génère alors une image de vous portant l'article. Vous n'êtes pas limité aux produits que ChatGPT a trouvés par lui-même : vous pouvez coller le lien d'un manteau repéré ailleurs, ou importer une capture d'écran, et demander à l'outil de vous le montrer sur vous. Dans la démonstration, je m'attends à ce que le second chemin soit le plus utile, car la plupart des gens ne commencent pas leurs achats dans un chatbot.
La seconde fonctionnalité est Favoris, une bibliothèque où vous pouvez enregistrer des produits et les organiser en dossiers. Les images d'essayage sont enregistrées aux côtés des articles, de sorte qu'un dossier devient un petit dressing visuel des pièces que vous évaluez.
OpenAI indique que les deux fonctionnalités reposent sur ChatGPT Images 2.5, le modèle d'image présenté en septembre. L'entreprise décrit les améliorations qui comptent pour ce cas d'usage : un éclairage plus naturel, des textures plus riches et une meilleure fidélité aux instructions d'édition. Ces trois éléments sont exactement ce dont un essayage convaincant a besoin. Une image générée qui se trompe d'éclairage ou transforme le tissu en plastique brise immédiatement l'illusion, et les utilisateurs jugent la fonctionnalité sur cette illusion, pas sur des scores de benchmark.
Les photos de référence sont enregistrées pour que vous n'ayez pas à importer le même selfie à chaque fois, et elles peuvent être gérées ou supprimées dans Paramètres, puis Personnalisation, puis Photos de référence. C'est un choix par défaut raisonnable pour la commodité, et un endroit prévisible pour que les questions de confidentialité atterrissent.
La mise en garde qu'OpenAI apporte à sa propre fonctionnalité
L'entreprise reconnaît d'emblée qu'il ne s'agit pas d'un système d'essayage. Une image générée montre à quoi un article pourrait ressembler, non comment une taille donnée tombera. Elle ne mesure pas votre corps et ne simule pas le tombé d'un vêtement. Les recommandations d'OpenAI invitent les utilisateurs à vérifier les mesures du marchand, les détails du produit et la politique de retour avant d'acheter.
Cette honnêteté mérite d'être soulignée, car elle définit la valeur réelle de la fonctionnalité. Pouvoir visualiser une tenue ne supprime pas les approximations de taille qui rendent l'achat de vêtements en ligne frustrant. Elle supprime une autre couche d'incertitude : celle de savoir si une couleur ou une silhouette vous va, avant de vous engager à commander un article pour l'essayer.
Il y a aussi un contexte concurrentiel. Google a introduit une capacité d'essayage similaire dans ses outils d'achat plus tôt, OpenAI n'est donc pas le premier ici. L'entreprise aurait également reculé sur ses ambitions de paiement instantané, ce qui fait apparaître la mise à jour essayage et Favoris moins comme un levier de conversion que comme un moyen de garder les gens en phase de recherche dans ChatGPT.
Pourquoi les modèles d'image finissent toujours dans le commerce
Le schéma qui sous-tend cette annonce est plus vaste qu'une seule fonctionnalité. Les tâches de génération d'images les plus utiles s'avèrent être celles qui s'inscrivent dans une autre tâche, où l'image n'est pas le produit mais une étape pour accomplir quelque chose.
Une cabine d'essayage en est un exemple. Modifier une photo pour changer la couleur d'une veste avant de la mettre en ligne en est un autre. Redessiner un produit sur un fond propre, corriger l'éclairage d'une pièce pour que l'annonce soit plus lisible, ou remettre en scène une photo immobilière sans équipe de home staging : tout cela a la même forme. Une personne a un objectif, et générer ou modifier une image est le moyen de l'atteindre.
Cette forme récompense des qualités différentes de celles d'une démo texte-image. Elle récompense la cohérence, car la personne a besoin que le même visage, le même vêtement et la même pièce survivent à plusieurs modifications. Elle récompense le respect des instructions, car l'utilisateur se soucie de la seule chose qu'il a demandé de changer et remarquera si autre chose a bougé. Elle récompense la latence, car une cabine d'essayage n'a rien d'amusant si elle prend une minute par essai. Ces trois points expliquent pourquoi c'est un modèle comme ChatGPT Images 2.5, présenté autour de la précision d'édition et de la rapidité, qui alimente la fonctionnalité, plutôt qu'un modèle conçu pour le spectacle.
Pour les créateurs et les développeurs, la leçon est de savoir où atterrissent l'argent et l'usage. Les générateurs autonomes comptent toujours, et leur marché ne se réduit pas. Mais le plus gros volume de génération d'images glisse vers des flux de travail où la sortie est jugée sur sa capacité à aider quelqu'un à finir une tâche, et non sur sa beauté propre. Un bouton d'essayage dans une liste d'achats est une petite fonctionnalité. C'est aussi le signe que le modèle d'image est devenu de la plomberie à l'intérieur du reste de l'application.
Pourquoi les outils d'essayage échouaient auparavant
L'essayage virtuel n'est pas nouveau. Les détaillants le proposent depuis des années, et Google en a intégré une version dans ses outils d'achat avant OpenAI. S'il n'est jamais devenu une partie par défaut du shopping en ligne, c'est que les premières implémentations n'étaient pas assez bonnes. Elles produisaient des images qui semblaient fausses de manière immédiatement perceptible : un vêtement qui collait au corps comme un film plastique, un visage qui perdait sa ressemblance, une manche qui traversait un bras, un éclairage qui appartenait à une autre photo. Quand le résultat ne vous ressemble pas, la fonctionnalité ajoute du doute au lieu d'en retirer.
Deux choses ont changé. Les modèles d'image sont devenus bien meilleurs pour préserver le sujet tout en modifiant une seule chose, ce qui est exactement la compétence dont un essayage a besoin. Et la génération est devenue plus rapide, ce qui compte plus qu'il n'y paraît. Une cabine d'essayage qui prend une minute par tentative est une nouveauté qu'on essaie une fois. Une qui répond en quelques secondes est une étape que l'on intègre à sa façon d'acheter. La description que fait OpenAI de ChatGPT Images 2.5 met l'accent sur un éclairage naturel, des textures plus riches et une latence réduite, et ces trois éléments correspondent directement aux trois façons dont l'essayage échouait auparavant.
L'écart qui subsiste est celui qu'OpenAI nomme elle-même. L'essayage montre à quoi quelque chose pourrait ressembler. Il ne dit pas si la taille conviendra, or c'est bien le problème qui génère les retours. Tant qu'un modèle ne saura pas raisonner sur la coupe d'un vêtement et vos mensurations, cette fonctionnalité réduit l'incertitude avant l'achat, pas celle qui suit la livraison.
La question de la confidentialité qui accompagne la commodité
L'enregistrement des photos de référence est ce qui rend la fonctionnalité agréable, et ce qui met les gens mal à l'aise. Le confort de ne pas avoir à réimporter une photo en pied à chaque session est réel. Tout comme le fait qu'une photo de votre corps réside désormais dans un compte qui construit aussi un profil de ce que vous voulez acheter.
OpenAI offre aux utilisateurs une option de suppression et une page de paramètres, ce qui constitue le minimum requis. Savoir si cela suffit dépendra de la clarté avec laquelle ce stockage est expliqué aux personnes qui n'ouvrent jamais cette page de paramètres. La fonctionnalité est gratuite, et le prix de tout ce qui est gratuit se paie généralement en données, un fait à garder en tête tant que la cabine d'essayage reste amusante à utiliser.
Articles associés
Les images produits par IA se heurtent à un mur de conformité que personne n’avait intégré dans ses coûts
Le coût a toujours été annoncé à la génération. Le coût réel se compte par visuel qui passe le contrôle.
Les robots peuvent effectuer 74 % du travail physique, et presque rien de tout cela n'est rentable
La capacité est largement présente. L'économie ne l'est pas. Quarante ans pour atteindre dix pour cent n'est pas une prévision qui justifie la panique.
Un modèle agentique à poids ouverts de 744 Md arrive sous licence MIT
La licence est le marketing. Un modèle de 744 Md que tout le monde peut télécharger rebat les cartes de l’arbitrage entre achat et construction.
Les modèles vidéo IA chinois débarquent à Hollywood : 73 plans dans les effets visuels de la série d'Amazon
Ce ne sont pas les séries qui s'exportent, mais les outils qui servent à les fabriquer.