← Zurück zum Blog
News6 Min.

ChatGPT Images 2.5 ist schneller, schärfer und lässt dich endlich skizzieren

Veröffentlicht 26. Sept. 2026
ChatGPT Images 2.5 ist schneller, schärfer und lässt dich endlich skizzieren

OpenAI hat ChatGPT Images 2.5 am 8. September 2026 veröffentlicht, und die Zahl, die alle sofort aufgegriffen haben, war die Geschwindigkeit: bis zu 50 Prozent niedrigere Latenz als bei der Vorgängerversion. Das ist wichtig, aber es unterschätzt, was sich geändert hat. Der interessantere Punkt ist, dass das Modell dich jetzt eine grobe Skizze zeichnen und als Referenz übergeben lässt und dass Bearbeitungen über mehrere Runden hinweg stabil bleiben, statt abzudriften.

Wenn du diese Tools zuletzt im Frühjahr benutzt hast, wirst du den Unterschied sofort bemerken. Das erste, was dir auffällt, ist die Wartezeit. Eine Generierung, die früher sechs Sekunden gedauert hat, ist jetzt in etwa drei Sekunden da. Das zweite: Wenn du eine kleine Änderung verlangst, bleibt der Rest des Bildes unverändert.

Was wirklich besser geworden ist

Die offizielle Liste umfasst drei Bereiche: Geschwindigkeit, Detailtreue und Bearbeitungsstabilität.

Geschwindigkeit ist am einfachsten zu überprüfen. OpenAI gibt an, dass die Latenz um bis zur Hälfte sinkt, und das Modell ist für Desktop, Mobile und Web verfügbar, sodass die Verbesserung überall ankommt und nicht nur bei der API.

Detailtreue ist der Bereich, in dem das Modell den größten Nachholbedarf hatte. Frühere Versionen waren stark bei der Komposition, konnten aber feine Texturen verschmieren und Materialdefinitionen verlieren. 2.5 setzt stärker auf Beleuchtung und Material-Rendering, sodass Haut, Stoff und Metall als das erkennbar sind, was sie sind, statt als glatte Annäherung.

Bearbeitungsstabilität ist der Punkt, der Menschen, die diese Tools tatsächlich nutzen, am wichtigsten ist. Die langjährige Beschwerde über Bildmodelle ist, dass eine Bearbeitung über mehrere Runden abdriftet. Du änderst die Hemdfarbe, und plötzlich ist das Gesicht anders. 2.5 ist darauf ausgelegt, das Motiv, die Produktform, die Komposition und den gesamten Stil zu bewahren, wenn du eine gezielte Änderung verlangst. Genau diese Korrektur spart im echten Einsatz mehr Zeit als jede Latenzzahl.

Eine grobe Bleistiftskizze verwandelt sich in ein ausgefeiltes fotorealistisches Bild

Die Sketch-Funktion ist der heimliche Hit

Die größte Produktneuheit ist Sketch. Du zeichnest direkt in ChatGPT ein grobes Layout, und das Modell macht daraus ein fertiges Bild. Du musst nicht zeichnen können. Ein paar Kästen, eine Strichfigur, eine Horizontlinie und eine Farbnotiz reichen aus, um eine Absicht zu vermitteln, für deren Beschreibung man sonst drei Absätze Prompting bräuchte.

Das schließt eine Lücke, die es seit den ersten Text-zu-Bild-Tools gibt. Prompts sind schlecht im räumlichen Denken. „Platziere das Produkt links, eine Überschrift oben rechts und eine Person im unteren Drittel“ sind viele Worte für etwas, das eine Skizze in zehn Sekunden vermittelt. Sketch gibt dem Modell so etwas wie ein Storyboard, und Storyboards sind die Art, wie visuelle Arbeit tatsächlich gebrieft wird.

Zwei API-Varianten für zwei verschiedene Aufgaben

Auf API-Seite hat OpenAI die Veröffentlichung in zwei Varianten mit klaren Rollen aufgeteilt.

GPT-Image-2.5 Flare ist das Allzweckmodell. Es bringt Geschwindigkeit, Qualität und Bearbeitung der 2.5-Serie mit und richtet sich an Social-Media-Assets, Produktprototypen und die Generierung großer Mengen, wenn du schnell viele Bilder brauchst.

GPT-Image-2.5 Sunburst ist das Präzisionsmodell. Es ist für Werbemotive und kommerzielle Produktaufnahmen gedacht, bei denen Kontrolle wichtiger ist als Durchsatz. Du bekommst stärkere Kontrolle über das Bild und zahlst dafür mit Generierungszeit.

Diese Aufteilung ist ein nützliches Signal dafür, wie der Markt gereift ist. Vor zwei Jahren versuchte ein Modell, alle zu bedienen. Jetzt schneiden die Anbieter nach Workload zu, denn „mach hundert Memes“ und „mach ein Kampagnen-Hero-Image“ sind wirklich unterschiedliche Aufgaben.

Der praktische Wandel: Behandle es als Editor, nicht als Generator

Das Upgrade ist am nützlichsten, wenn du aufhörst, das Modell wie einen Spielautomaten zu behandeln, und anfängst, es wie einen Editor zu nutzen. Der alte Workflow war: Prompt schreiben, vier Bilder generieren, das beste auswählen, und wenn keins passte, einen besseren Prompt schreiben und erneut generieren. Genau diese Schleife war der Ort, an dem die meiste Frustration lebte.

Der Workflow mit 2.5 ist anders. Du beginnst mit einer groben Idee, generierst etwas Brauchbares und verfeinerst es dann durch eine Reihe kleiner, gezielter Änderungen. Ändere den Hintergrund. Passe die Beleuchtung an. Verschiebe ein Objekt. Weil Bearbeitungen jetzt den Rest des Bildes stabil halten, ist jeder Schritt eine echte Verbesserung statt eines Glücksspiels.

Auch hier macht sich Sketch bezahlt. Wenn die räumliche Anordnung wichtig ist, schlägt eine schlechte Zeichnung eine lange Beschreibung. Zeichne, wo die Überschrift hin soll, wo das Produkt steht und wo die Person positioniert ist. Das Modell liefert die Qualität. Du lieferst die Absicht.

Eine Gewohnheit solltest du beibehalten: Prüfe die Details, bevor du das Ergebnis als fertig bezeichnest. Kein Modell ist perfekt, und 2.5 produziert immer noch gelegentlich eine verunstaltete Hand oder einen falschen Buchstaben. Der Unterschied ist jetzt, dass die Fehler selten genug sind, um eine weitere Bearbeitung wert zu sein, statt Grund genug, das Bild aufzugeben und von vorn zu beginnen. Genau das bedeutet „brauchbar“ – mehr als jeder Benchmark.

Was das für das Feld bedeutet

Der Kontext, den man kennen sollte, ist die Größenordnung. OpenAI hat gesagt, dass die ChatGPT-Images-Familie und ihre API mehr als drei Milliarden Bilder pro Woche produzieren. Das ist eine Zahl, die 2023 absurd geklungen hätte und jetzt nur die Basis ist.

Das erklärt auch, warum OpenAI es sich leisten kann, zu konsolidieren. In derselben Woche, in der 2.5 erschien, hat das Unternehmen stillschweigend das alte DALL-E-GPT innerhalb von ChatGPT eingestellt und alle auf ChatGPT Images verwiesen. Der Name DALL-E mag verschwunden sein, aber seine Aufgabe ist vollständig in eine schnellere, schärfere Pipeline übergegangen.

Für die Konkurrenz ist der Druck spezifisch. Midjourney besitzt immer noch die reine ästhetische Bandbreite, und niemand bestreitet das ernsthaft. Adobe Firefly besitzt immer noch den kommerziellen Lizenzierungsaspekt für vorsichtige Unternehmen. Googles Nano-Banana-Reihe gewinnt weiterhin bei nativer hoher Auflösung und Charakterkonsistenz. ChatGPT Images 2.5 versucht nicht, jeden in seinem eigenen Spiel zu schlagen. Es versucht, der beste Standard zu sein: schnell genug, scharf genug und jetzt gut genug beim Bearbeiten, dass du aufhörst, nach einem zweiten Tool zu greifen.

Das ehrliche Fazit ist, dass 2.5 eine Iteration ist, keine Revolution. Aber es ist eine Iteration genau bei den drei Dingen, die Bildmodelle in der echten Arbeit nervig gemacht haben. Geschwindigkeit, Detailtreue und Bearbeitungsstabilität sind nicht glamourös. Sie sind nur die Gründe, warum jemand ein Tool aufgibt. OpenAI hat diese Version darauf verwendet, diese Gründe einen nach dem anderen aus dem Weg zu räumen.

Verwandte Artikel