← Zurück zum Blog
News6 Min.

Microsofts MAI-Image-2.6 holt still zu GPT Image 2 auf

Veröffentlicht 26. Sept. 2026
Microsofts MAI-Image-2.6 holt still zu GPT Image 2 auf

Die meiste Zeit des Jahres 2026 war die KI-Bildgeschichte ein Zweikampf zwischen OpenAI und Google. Diese Sichtweise wirkt zunehmend unvollständig. Microsofts MAI-Image-2.6-Preview ist in der Bestenliste schnell genug aufgestiegen, sodass der Abstand zu GPT Image 2 nur noch 21 Elo-Punkte beträgt.

Die Zahl ist wichtig wegen der Art, wie sie sich bewegt hat. Als GPT Image 2 am 21. April startete, baute es seinen Vorsprung von rund 67 Elo im Juli auf etwa 97 im August aus. Dann drückte Microsoft ihn bis September auf 21. Das ist kein Produkt, das stabil bleibt. Das ist ein Herausforderer, der beschleunigt.

Die Bestenliste auf einen Blick

Stand September 2026 liegt GPT Image 2 in der Text-zu-Bild-Arena von Artificial Analysis bei 1.370 Elo. MAI-Image-2.6-Preview liegt bei 1.349. In der Bildbearbeitungs-Arena hält GPT Image 2 mit 1.255 den ersten Platz, doch es gilt dieselbe Entwicklung: Microsoft holt auf.

Bei der speziellen Fähigkeit, die derzeit alle am meisten interessiert – der Textwiedergabe – sind GPT Image 2 und Googles Nano Banana Pro gemeinsam führend. FLUX.2 gilt als bestes offenes Modell für Typografie. Microsofts Modell wurde in dieser Kategorie noch nicht gekrönt, aber sein allgemeiner Aufstieg deutet darauf hin, dass es auf ganzer Linie wettbewerbsfähig ist.

Zwei Kontrahenten liefern sich ein Kopf-an-Kopf-Rennen, eine Visualisierung des schrumpfenden Bestenlisten-Abstands

Warum Microsofts Position anders ist

Die meisten Herausforderer in diesem Bereich sind entweder Start-ups oder Labs ohne bestehende Enterprise-Präsenz. Microsoft ist das nicht. MAI-Image-2.6 ist ein einsetzbares Modell innerhalb des Microsoft-Ökosystems, was bedeutet, dass Azure, Copilot und der gesamte Enterprise-Stack zu einem Vertriebskanal werden.

Das ist der stille Teil dieser Geschichte. OpenAI und Google verkaufen Bilder über Verbraucherprodukte und APIs. Microsoft kann sie über den Beschaffungsprozess von Unternehmen verkaufen, die bereits für Microsoft-Infrastruktur zahlen. Für ein Unternehmen, das entscheidet, wohin es seine Bilderzeugung leitet, ist „es ist bereits in Azure“ ein echtes Argument.

Das Modell selbst spiegelt auch den Trend zur multimodalen Integration wider. Microsoft integriert die Bilderzeugung zunehmend in seine Assistenz-Oberflächen, und ein starkes, selbst hostbares Bildmodell gibt diesen Oberflächen einen Existenzgrund, ohne von der API eines Konkurrenten abhängig zu sein.

Was noch offen ist

Ein paar Einschränkungen sollte man klar benennen.

Der Elo-Abstand beträgt 21 Punkte, was bedeutsam, aber kein Erdrutschsieg ist. Die Positionen in der Bestenliste verschieben sich von Monat zu Monat, und ein Vorschaumodell kann starke Werte erzielen, ohne sie unter Produktionsbedingungen zu halten. MAI-Image-2.6 trägt weiterhin das Label Preview.

Die Preisgestaltung für Microsofts Bildmodelle war zudem weniger transparent als die veröffentlichten Preise pro Bild von OpenAI oder Google. Für ein Unternehmen, das die Option prüft, ist das ein Reibungspunkt, obwohl Enterprise-Lizenzen ohnehin oft zu individuellen Konditionen funktionieren.

Und die Bestenliste selbst misst nur bestimmte Dinge. Elo-Werte aus blinden Abstimmungen belohnen Prompt-Treue und allgemeine Attraktivität. Sie erfassen weder die Lizenzbedingungen noch die Wasserzeichen-Politik oder wie sich ein Modell bei der Inhaltsmoderation verhält – all das zählt für ein Unternehmen, das die Ergebnisse vor Kunden bringt, mehr als ein paar Elo-Punkte.

Was das Modell wirklich gut kann

Abseits der Bestenlisten-Zahl deuten die frühen Berichte zu MAI-Image-2.6 auf ein Modell hin, das dort stark ist, wo der Markt gerade steht: allgemeine Prompt-Treue und saubere, stimmige Ergebnisse über eine Reihe von Stilen hinweg.

Microsoft hat es nicht als Stilisten positioniert. Das Verkaufsversprechen ist Nutzen. Es ist ein Modell, das sich in Copilot und Azure einfügt, zuverlässige Bilder für Produkt-Mockups, Marketingmaterialien und interne Designarbeit produziert – und das ohne die ästhetische Persönlichkeit von Midjourney oder den rohen Fotorealismus von Nano Banana Pro.

Diese Positionierung als „langweilig, aber zuverlässig“ ist im Enterprise-Einkauf ein Feature. Ein Unternehmen, das tausend markenkonforme Bilder pro Monat erzeugt, will kein Modell mit eigenen Meinungen. Es will Konsistenz, und Microsoft wettet darauf, dass Konsistenz plus der Azure-Kanal ausreicht, um den beiden Marktführern einen Marktanteil abzunehmen.

Die kommende Multi-Modell-Realität

Die größere Geschichte ist nicht, dass Microsoft OpenAI einholen könnte. Sie ist, dass die Bilderzeugung zu einer Ware mit mehreren glaubwürdigen Anbietern wird, und das verändert die Denkweise der Käufer.

Vor einem Jahr war die vernünftige Standardwahl: „Nimm das beste Modell.“ Heute lautet die vernünftige Standardwahl: „Nimm das Modell, das zu Ihrem Stack, Ihrem Budget und Ihren Lizenzanforderungen passt.“ Ein Unternehmen, das bereits auf Azure ist, wird aus demselben Grund standardmäßig zu Microsofts Modell greifen, aus dem ein Unternehmen auf Google Cloud standardmäßig zu Nano Banana greift: Die Integrationskosten für alles andere sind real.

Deshalb ist der 21-Punkte-Elo-Abstand weniger wichtig, als es scheint. Elo misst Prompt-Treue, nicht die Gesamtbetriebskosten. Und bei der Kennzahl, die den Enterprise-Einkauf tatsächlich antreibt, hat Microsoft einen strukturellen Vorteil, den die anderen mit einer Modellveröffentlichung allein nicht erreichen können.

Worauf man achten sollte

Drei Signale zeigen Ihnen, ob dies eine echte Verschiebung oder nur ein Ausreißer in der Bestenliste ist.

Erstens das Preview-Label. Wenn MAI-Image-2.6 in die allgemeine Verfügbarkeit geht und seine Elo-Position hält, ist das die Bestätigung. Eine Vorschau kann starke Zahlen liefern, ohne den Produktionsbeschränkungen eines veröffentlichten Modells zu unterliegen.

Zweitens die Preistransparenz. Microsoft war bei den Preisen pro Bild zurückhaltender als OpenAI und Google. Wenn diese Informationen vorliegen, wird der Gesamtkostenvergleich möglich, und viele Beschaffungsentscheidungen werden daraus folgen.

Drittens, was Copilot tut. In dem Moment, in dem MAI-Image-2.6 beginnt, Bilder in großem Umfang innerhalb von Copilot zu erzeugen, ist es keine Benchmark-Geschichte mehr, sondern eine Vertriebsgeschichte. Das ist die Kennzahl, die den Markt tatsächlich bewegen wird.

Vorerst lautet die sichere Zusammenfassung: GPT Image 2 liegt weiterhin vorn, aber die Einordnung als „klarer Marktführer“ ist nur noch begrenzt haltbar. Microsoft hat das Modell, den Kanal und die Entwicklung. Es muss nur alle drei in dieselbe Richtung weisen.

Was das für die kommenden Monate bedeutet

Die praktische Schlussfolgerung ist, dass die Frage „Welches Modell?“ bald komplizierter wird, nicht einfacher. Wenn Sie bisher auf GPT Image 2 standardisiert haben, weil es der klare Marktführer war, ist September 2026 ein vernünftiger Zeitpunkt, die Bewertung erneut durchzuführen.

Das bedeutet keinen Wechsel. GPT Image 2 liegt weiterhin vorn, und ein Vorsprung von 21 Punkten ist ein Vorsprung. Es bedeutet, dass die Ära einer einzigen offensichtlichen Antwort in der KI-Bilderzeugung zu Ende geht, und Microsoft ist der Hauptgrund dafür.

Für Entwickler ist das Signal einfacher: Achten Sie darauf, wann MAI-Image-2.6 den Preview-Status verlässt, und beobachten Sie, was Microsoft innerhalb von Azure und Copilot damit macht. Dort wird die Marktwirkung eintreten – mehr als in irgendeiner Bestenlisten-Zahl.

Verwandte Artikel