ChatGPT Images 2.5 est plus rapide, plus net et vous permet enfin d'esquisser

OpenAI a livré ChatGPT Images 2.5 le 8 septembre 2026, et le chiffre que tout le monde a retenu était la vitesse : jusqu'à 50 % de latence en moins par rapport à la version précédente. C'est important, mais cela sous-estime ce qui a changé. Le plus intéressant est que le modèle vous permet désormais de dessiner un croquis approximatif et de le fournir comme référence, et que les modifications tiennent sur plusieurs tours au lieu de dériver.
Si vous avez utilisé ces outils pour la dernière fois au printemps, la différence sera immédiate. La première chose que vous remarquez, c'est l'attente. Une génération qui prenait six secondes arrive maintenant en trois environ. La deuxième chose que vous remarquez, c'est que lorsque vous demandez un petit changement, le reste de l'image reste en place.
Ce qui s'est vraiment amélioré
La liste officielle couvre trois domaines : la vitesse, le détail et la stabilité des modifications.
La vitesse est le plus facile à vérifier. OpenAI annonce une latence réduite jusqu'à la moitié, et le modèle est disponible sur ordinateur, mobile et web. L'amélioration profite donc partout, pas seulement sur l'API.
Le détail est le domaine où le modèle avait le plus de marge de progression. Les versions précédentes étaient bonnes sur la composition, mais pouvaient brouiller les textures fines et perdre la définition des matériaux. La 2.5 accentue le rendu de l'éclairage et des matériaux : la peau, le tissu et le métal ressemblent enfin à ce qu'ils sont, au lieu d'une approximation lisse.
La stabilité des modifications est ce qui importe le plus aux personnes qui utilisent vraiment ces outils. Le reproche de longue date fait aux modèles d'images, c'est qu'une modification en plusieurs tours dérive. Vous changez la couleur de la chemise et, tout à coup, le visage devient différent. La 2.5 est conçue pour préserver le sujet, la forme du produit, la composition et le style général lorsque vous demandez un changement ciblé. Cette seule correction fait gagner plus de temps réel que n'importe quel chiffre de latence.

La fonctionnalité Sketch est le succès surprise
Le plus gros ajout de produit est Sketch. Vous dessinez une mise en page approximative directement dans ChatGPT, et le modèle la transforme en image finale. Pas besoin de savoir dessiner. Quelques rectangles, un personnage en bâtons, une ligne d'horizon et une note de couleur suffisent à communiquer une intention qu'il faudrait trois paragraphes de prompt pour décrire.
Cela comble un fossé qui existait depuis les premiers outils de texte vers image. Les prompts sont mauvais pour la pensée spatiale. « Mettez le produit à gauche, un titre en haut à droite et une personne dans le tiers inférieur » représente beaucoup de mots pour quelque chose qu'un croquis communique en dix secondes. Sketch donne au modèle quelque chose qui ressemble davantage à un storyboard, et les storyboards sont la façon dont le travail visuel est réellement briefé.
Deux variantes d'API pour deux types de tâches
Côté API, OpenAI a divisé la sortie en deux variantes aux rôles clairs.
GPT-Image-2.5 Flare est le modèle polyvalent. Il reprend la vitesse, la qualité et l'édition de la série 2.5, et il vise les visuels pour les réseaux sociaux, les prototypes de produits et la génération en grand volume où il faut beaucoup d'images rapidement.
GPT-Image-2.5 Sunburst est le modèle de précision. Il est conçu pour les images publicitaires et les photos produit commerciales, où le contrôle compte plus que le débit. Vous obtenez un contrôle plus fort sur l'image, et vous le payez en temps de génération.
Cette division est un signal utile sur la maturation du marché. Il y a deux ans, un seul modèle essayait de servir tout le monde. Aujourd'hui, les fournisseurs segmentent par charge de travail, car « créer cent mèmes » et « créer une image héros de campagne » sont des tâches réellement différentes.
Le changement pratique : traitez-le comme un éditeur, pas comme un générateur
La mise à niveau est plus utile si vous arrêtez de traiter le modèle comme une machine à sous et commencez à le traiter comme un éditeur. L'ancien flux de travail consistait à écrire un prompt, générer quatre images, choisir la meilleure, et quand aucune ne fonctionnait, écrire un meilleur prompt et générer à nouveau. C'est dans cette boucle que résidait l'essentiel de la frustration.
Le flux de travail avec la 2.5 est différent. Vous partez d'une idée approximative, générez quelque chose d'acceptable, puis vous affinez par une série de petites modifications ciblées. Changez l'arrière-plan. Ajustez l'éclairage. Déplacez un objet. Comme les modifications maintiennent désormais le reste de l'image stable, chaque étape est une vraie amélioration au lieu d'un pari.
C'est aussi là que Sketch devient rentable. Quand la disposition spatiale compte, un mauvais dessin vaut mieux qu'une longue description. Dessinez où va le titre, où se trouve le produit, où se tient la personne. Le modèle apporte la qualité. Vous fournissez l'intention.
Une habitude mérite d'être conservée : vérifiez les détails avant de considérer que c'est terminé. Aucun modèle n'est parfait, et la 2.5 produit encore parfois une main déformée ou une mauvaise lettre. La différence, c'est que les erreurs sont désormais assez rares pour mériter une modification de plus, plutôt qu'une raison suffisante d'abandonner l'image et de recommencer. C'est cela, plus que n'importe quel benchmark, qui définit ce qu'est un outil « utilisable ».
Ce que cela change pour le secteur
Le contexte à connaître, c'est l'échelle. OpenAI a déclaré que la famille ChatGPT Images et son API produisent plus de trois milliards d'images par semaine. C'est un chiffre qui aurait paru absurde en 2023 et qui est désormais la simple référence.
Cela explique aussi pourquoi OpenAI peut se permettre de consolider. La même semaine où l'entreprise a livré la 2.5, elle a discrètement mis à la retraite l'ancien DALL-E GPT dans ChatGPT, orientant tout le monde vers ChatGPT Images. Le nom DALL-E a peut-être disparu, mais le travail qu'il faisait a été entièrement absorbé dans un pipeline plus rapide et plus net.
Pour la concurrence, la pression est spécifique. Midjourney domine toujours le registre purement esthétique, et personne ne le conteste sérieusement. Adobe Firefly domine toujours l'angle des licences commerciales pour les entreprises prudentes. La gamme Nano Banana de Google gagne toujours sur la haute résolution native et la cohérence des personnages. ChatGPT Images 2.5 n'essaie pas de battre chacun sur son propre terrain. Il essaie d'être le meilleur choix par défaut : assez rapide, assez net, et désormais assez bon en édition pour que vous cessiez de chercher un second outil.
La conclusion honnête est que la 2.5 est une itération, pas une révolution. Mais c'est une itération portant précisément sur les trois choses qui rendaient les modèles d'images pénibles à utiliser dans le travail réel. La vitesse, le détail et la stabilité des modifications ne sont pas glamour. Ce sont simplement les raisons pour lesquelles une personne abandonne un outil. OpenAI a passé cette version à éliminer ces raisons une par une.
Articles associés
En septembre, les modèles open source chinois de génération d'images ripostent coup sur coup : SenseTime, Ant Group et InternLM ne restent pas les bras croisés
SenseTime 8B, Ant Group 6B et InternLumina-U2 ont été publiés coup sur coup en open source. Cet article décortique les différences d'approche des trois acteurs et l'impact réel de cette vague open source sur les créateurs.
Tencent Hunyuan fait entrer la génération d’images par IA sur les plateaux de tournage : prise en main de HyImage 3.5 preview
HyImage 3.5 preview affiche un gain d’environ 30 % en test aveugle, prend en charge jusqu’à 5 images de référence et une sortie 2K, est intégré à WorkRally et a été mis à l’épreuve dans « Xing Biao ». Cet article décrypte ses capacités et ses modes d’utilisation.
Les meilleurs générateurs d'images IA de septembre 2026, classés
GPT Image 2.5, Midjourney V8.2, Nano Banana 2, Flux 2 et plus, classés avec les prix et des recommandations par usage.
Le MAI-Image-2.6 de Microsoft se rapproche discrètement de GPT Image 2
Le challenger de Microsoft a réduit l'écart Elo à 21 points. Ce que la montée de MAI-Image-2.6 signifie pour le marché de l'image par IA.