Die offiziellen OpenAI-Unterlagen liefern drei belastbare Anhaltspunkte: Es gibt eine GPT-Image-2-Modellseite in der OpenAI-API-Dokumentation. Der Leitfaden zur Bildgenerierung beschreibt sowohl das Erzeugen neuer Bilder aus Textprompts als auch das Bearbeiten vorhandener Bilder. Außerdem nennt die API-Referenz für Bildbearbeitung Eingabebilder, das zu verwendende Modell und Parameter für die Anzahl generierter Bilder.
Das reicht für einen pragmatischen Produktionsversuch: Teams können GPT Image 2 in einen Workflow aus Referenzbild, Bildbearbeitung, Variantenproduktion und menschlicher Abnahme einbauen. Es reicht aber nicht für die stärkere Aussage, OpenAI habe offiziell garantiert, dass GPT Image 2 über eine ganze Motivserie hinweg denselben Charakter, dasselbe Produkt oder denselben Markenstil stabil beibehält.
Die OpenAI-API-Dokumentation enthält eine Seite zum „GPT Image 2 Model“. Damit ist belegt, dass GPT Image 2 innerhalb der OpenAI-Dokumentation als Modell aufgeführt wird.
OpenAI beschreibt im Bildgenerierungsleitfaden zwei Kernwege: Bilder können aus einem Textprompt neu erzeugt werden; vorhandene Bilder können außerdem bearbeitet werden. Für Kreativteams heißt das: Das Modell kann grundsätzlich in zwei typische Arbeitsweisen eingebunden werden — einmal für neue visuelle Konzepte, einmal für Varianten auf Basis bestehender Charakter-, Produkt- oder Markenbilder.
Die API-Referenz zur Bildbearbeitung nennt unter anderem die zu bearbeitenden Bilder, das zu verwendende Modell und die Anzahl der zu generierenden Bilder als Parameter. Genau daraus ergibt sich ein testbarer Ansatz: Ein Team kann dieselbe Referenzgrafik oder dasselbe Produktbild mehrfach in unterschiedliche Szenen, Formate oder Ausschnitte übertragen und anschließend prüfen, wie stabil die relevanten Details bleiben.
Konsistenz in einer Kampagne bedeutet mehr als „sieht ungefähr ähnlich aus“. Bei einer wiederkehrenden Figur zählen Gesichtszüge, Frisur, Körperform, Kleidung, Proportionen und Posenlogik. Bei Produktbildern geht es um Form, Material, Logo, Verpackungstext, Etikettenposition und Größenverhältnisse. Bei Markenmotiven kommen Farben, Bildsprache, Komposition, Typografie und No-go-Regeln hinzu.
Die offiziellen Quellen belegen, dass GPT Image 2 dokumentiert ist und dass OpenAI Workflows für Bildgenerierung und Bildbearbeitung beschreibt. Sie liefern aber in den hier sichtbaren Angaben keinen eindeutigen Wortlaut, der eine durchgehend konsistente Produktion kompletter Asset-Sets offiziell zusichert. Die sauberere Formulierung lautet daher: Es gibt einen technischen Weg, Konsistenz zu testen und womöglich zu verbessern. Ein offizielles Konsistenzversprechen ist das nicht.
Einige Drittanbieter formulieren deutlich offensiver. Ein externer Artikel behauptet etwa, GPT-Image-2 könne im „Thinking Mode“ bis zu acht zusammenhängende Bilder aus einem Prompt erzeugen, mit konsistenten Charakteren, Objekten, Farben und Kompositionen. Solche Aussagen können ein Marktsignal sein, ersetzen aber keine offizielle OpenAI-Spezifikation.
Auch in der OpenAI Developer Community wird der Bedarf nach Charakterkonsistenz und Style-Locking diskutiert. In einem anderen Community-Beitrag berichten Nutzer von inkonsistenten Charakterbildern trotz hoher Eingabetreue. Diese Beiträge sind ebenfalls keine Produktspezifikation. Für Teams sind sie trotzdem nützlich, weil sie zeigen, wo echte Produktionsrisiken liegen können: Die eigene Bildwelt muss getestet werden, nicht nur der Modellname.
Wer Anzeigenserien, Produkt-Szenenbilder, Charakter-Storyboards oder wiederkehrende Social-Media-Visuals plant, sollte GPT Image 2 zunächst als prüfbares Werkzeug behandeln — nicht als vollautomatisches System mit garantierter Marken- und Charaktertreue.
Vor dem ersten Test sollten alle unverhandelbaren Elemente gesammelt werden: Charakter-Sheets, Produktansichten, Brandfarben, Logo-Regeln, typische Hintergründe, gewünschte Lichtstimmung und verbotene Varianten. Bei Figuren gehören Gesicht, Frisur, Kleidung, Körperform und nicht veränderbare Merkmale in die Prüfliste. Bei Produkten sollten Proportionen, Material, Verpackungstext, Logo-Position und Details der Markenidentität definiert sein.
Da OpenAI sowohl die Generierung aus Textprompts als auch die Bearbeitung vorhandener Bilder beschreibt, und die Edit-API Eingabebilder sowie mehrere generierte Ausgaben unterstützt, liegt ein Test mit Referenzbildern nahe. Praktisch heißt das: dieselbe Figur, dasselbe Produkt oder dasselbe Marken-Key-Visual als Ausgangspunkt verwenden und dann systematisch andere Szenen, Blickwinkel, Formate und Zuschnitte erzeugen.
Konsistenzprobleme tauchen oft nicht im ersten Bild auf, sondern im zweiten, fünften oder zehnten Motiv. Ein brauchbarer Test sollte deshalb verschiedene Posen, Hintergründe, Lichtstimmungen, Kameradistanzen, Seitenverhältnisse und Ausgabekanäle abdecken. Bei Produktmotiven sind Verpackungstexte, Logos, Flaschen- oder Schachtelproportionen kritisch; bei Charakteren vor allem Gesicht, Frisur, Kleidung und Körperform.
Das OpenAI Cookbook enthält Beispiele für Image Evals in Anwendungsfällen zur Bildgenerierung und Bildbearbeitung. Daraus lässt sich ein eigener Prüfprozess ableiten: Identität des Charakters, Produktdetails, Markenfarben, Logo und Text, Kompositionsstil, Nutzbarkeit, Nachbearbeitungsbedarf. Erst wenn mehrere Testdurchläufe definierte Schwellenwerte erreichen, sollte der Workflow in die laufende Content-Produktion wandern.
Wenn eine Marke keine verzerrten Logos, falschen Verpackungstexte, veränderten Gesichter oder verschobenen Produktproportionen akzeptieren kann, braucht der Prozess weiterhin Review, Retusche und gegebenenfalls Neugenerierung. Das schmälert den Nutzen von GPT Image 2 nicht. Es verhindert nur, dass generative Bildfähigkeit mit garantierter Markenführung verwechselt wird.
Nicht ratsam wäre eine Formulierung wie:
GPT Image 2 garantiert, dass ein Charakter, ein Produkt und ein Markenstil über ein komplettes Asset-Set hinweg vollständig identisch bleiben.
Deutlich belastbarer ist:
OpenAI-Dokumente zeigen, dass GPT Image 2 in der Modelldokumentation geführt wird und dass die Bild-API Workflows für Generierung und Bearbeitung unterstützt. Marken- oder Charakterserien können über Referenzbilder, Edits, Variantenproduktion und Evaluation auf Konsistenz getestet werden. Aus den derzeit sichtbaren offiziellen Belegen sollte jedoch nicht abgeleitet werden, OpenAI garantiere eine stabile, durchgängige Konsistenz desselben Charakters, Produkts oder Markenstils über komplette Asset-Sets hinweg.
Ausprobieren: ja. Als offiziell bewiesene Serienkonsistenz verkaufen: nein.
Die realistische Rolle von GPT Image 2 liegt derzeit in einem kontrollierten Workflow aus Referenzbildern, Bildbearbeitung, Variantenproduktion, Batch-Evaluation und menschlicher Endkontrolle. Wer daraus ein Versprechen für automatisch perfekt konsistente Kampagnensets macht, geht über das hinaus, was die offiziellen Belege derzeit tragen.