Mit GPT Image 2 aus Text oder Referenzbildern erstellen

GPT Image 2 ist ein Bildmodell von OpenAI, das neue Bilder aus Prompts erstellt oder vorhandenes Bildmaterial als Ausgangspunkt nutzt. Wähle auf aiimg.me den passenden Workflow, prüfe Seitenverhältnis, Ausgabestufe, Anzahl und Credit-Schätzung und generiere anschließend im Browser.

Dekorative Collage für Text-zu-Bild und referenzbasierte Erstellung

Beginne mit der Eingabe, die die Richtung am klarsten vorgibt

Ein Modell für neue Bilder und referenzbasierte Änderungen

OpenAI beschreibt GPT Image 2 als Modell mit Text- und Bildeingabe, Bildausgabe sowie Funktionen zur Erzeugung und Bearbeitung. aiimg.me teilt diese Möglichkeiten in Text-zu-Bild und Bild-zu-Bild auf. Diese Seite erklärt die aktuell auf aiimg.me verfügbaren Einstellungen, nicht die gesamte offizielle API.

Das Modell ist hilfreich, solange Motiv, Umgebung, Komposition, Farbwelt, Material oder Stil noch entschieden werden. Du kannst diese Angaben beschreiben oder als Referenz zeigen. Muss eine fertige Datei außerhalb einer exakten Korrektur unverändert bleiben, ist ein deterministischer Editor die bessere Wahl.

Offizielle GPT-Image-2-Modelldokumentation lesen

Gut geeignet für

  • Ein Produkt-, Kampagnen-, Editorial- oder Social-Briefing in eine erste Bildrichtung übersetzen.
  • Vor der Produktion Alternativen für Umgebung, Farbwelt, Material, Ausschnitt oder Licht prüfen.
  • Produktfoto, Skizze, früheres Ergebnis, Pose oder Layout als Kontext für eine neue Version nutzen.
  • Eine kleine Auswahl im Seitenverhältnis der späteren Platzierung vergleichen.

Nimm ein anderes Werkzeug für

  • Ebenen, Pinselmasken, gesperrte Bereiche oder wiederholbare Korrekturen auf Pixelebene.
  • Verlustfreie Restaurierung oder garantiertes Hochskalieren einer vorhandenen Datei.
  • Exakte Typografie, Logos, Maße oder compliancekritische Geometrie.
  • Identische Figuren, Gesichter, Markenelemente oder Quelldetails über mehrere Ausgaben hinweg.

Text-zu-Bild oder Bild-zu-Bild?

Entscheidend ist, wo die verlässlichste Information liegt. Nutze Text, wenn das Briefing die Richtung trägt. Wähle Bild-zu-Bild, wenn sich Motiv, Aufbau oder Look leichter zeigen als beschreiben lassen.

Text-zu-Bild, wenn das Briefing die Vorgabe ist

Beginne mit Motiv und Verwendungszweck und ergänze Umgebung, Komposition, Licht, Material, Farbe und Stimmung. Zum Beispiel: „Editoriales Produktfoto einer matt kobaltblauen Schreibtischlampe auf hellem Kalkstein, weiches Seitenlicht, 4:5-Komposition, viel Freiraum über der Lampe für eine Überschrift.“

Bild-zu-Bild, wenn die Vorlage wichtige Informationen enthält

Lade mindestens ein Bild hoch, gib jeder Referenz eine Aufgabe und beschreibe die Änderung. Beispiel: „Referenz 1 nur für Flaschensilhouette und frontalen Kamerawinkel. Referenz 2 nur für die Sandsteinpalette. Flasche auf hellem Travertin mit warmem morgendlichem Seitenlicht.“ Referenzen leiten eine neue Generierung, sperren aber nicht jeden Pixel.

Wähle den kleinsten Durchlauf, der deine nächste Frage beantwortet

Vor „Generieren“ berechnet der Arbeitsbereich die Gesamtkosten aus Ausgabestufe und Anzahl. Ein einzelnes 1K-Ergebnis ist der günstigste Weg, Komposition und Anweisung zu prüfen. Erhöhe Stufe oder Anzahl nur für einen konkreten nächsten Arbeitsschritt.

Bilder1K2K4K
110 Credits20 Credits40 Credits
220 Credits40 Credits80 Credits
440 Credits80 Credits160 Credits

1K: Briefing prüfen, bevor du den Durchlauf vergrößerst

Für 10 Credits pro Bild ist 1K der wirtschaftliche erste Test für Motiv, Ausschnitt, Farbwelt und Prompt-Logik. Es ist ein Entscheidungswerkzeug, keine kleinere Ausgabe einer noch ungeklärten Idee.

2K: eine größere Arbeitsdatei anfordern

2K kostet 20 Credits pro Bild und ist sinnvoll, wenn die Richtung feststeht und eine größere Ausgabe im nächsten Schritt hilft. Die Einstellung löst einen Größenbedarf, ersetzt aber keine weitere Prompt-Überarbeitung.

4K: höchste Stufe nur bei echtem Größenbedarf

4K kostet 40 Credits pro Bild und damit viermal so viel wie 1K. Die Ausgabestufe ändert sich, eine vage Anweisung, unerwünschte Objekte, falscher Text oder eine schwache Komposition jedoch nicht.

Eine Ausgabe zum Prüfen, zwei oder vier zum Vergleichen

Fordere beim Prüfen eines Prompts nur ein Bild an. Wähle zwei oder vier, wenn parallele Varianten die Entscheidung erleichtern; die Kosten pro Bild werden mit der Anzahl multipliziert. Nach „Generieren“ wird jede Aufgabe berechnet. Für als fehlgeschlagen erfasste Aufgaben werden verbrauchte Credits erstattet.

Seitenverhältnis nach dem vorgesehenen Einsatz wählen

Verfügbar sind Auto, 1:1, 5:4, 9:16, 21:9, 16:9, 4:3, 3:2, 4:5, 3:4, 2:3. Nutze Auto bei offenem Layout, 1:1 für quadratische Flächen, 4:5 oder 3:4 für Hochformat, 9:16 für vertikale Displays und 16:9 oder 21:9 für breite Kompositionen. Lege das Ziel möglichst vorher fest; ein späterer Zuschnitt kann wichtigen Freiraum entfernen.

Referenzbilder nur nutzen, wenn jedes eine Aufgabe hat

Bild-zu-Bild benötigt mindestens eine Referenz und akzeptiert bis zu 16. Jede Datei darf bis zu 30 MB groß sein; unterstützt werden JPG, JPEG, PNG, WEBP. Das Maximum hilft, wenn verschiedene Bilder verschiedene Fakten liefern, und ist kein Ziel für jede Aufgabe.

Beginne mit der kleinsten Auswahl, die die Aufgabe erklärt. Widersprechen sich Referenzen bei Form, Kamerawinkel, Farbwelt oder Licht, benenne das Bild, das die jeweilige Entscheidung steuert. Zusätzliche Eingaben können Kontext liefern, aber auch konkurrierende Richtungen erzeugen.

Lade nur Material hoch, das du verwenden darfst, und lies vor vertraulichen oder sensiblen Bildern unsere Datenschutzerklärung .

Vom Briefing zum geprüften Ergebnis in vier Schritten

Ein sinnvoller Durchlauf beginnt vor dem Klick auf „Generieren“. Entscheide, ob Text oder Bild die verlässlichere Grundlage ist, wähle den passenden Workflow, setze nur so viele Credits wie nötig ein und prüfe das Ergebnis, bevor du weitermachst.

  1. 01

    Lege die verlässliche Grundlage fest

    Nutze Text-zu-Bild, wenn das Briefing die Szene ausreichend beschreibt. Wähle Bild-zu-Bild, wenn Motiv, Aufbau, Pose, Ausschnitt, Farbwelt oder Material aus einer Vorlage kommen sollen.

  2. 02

    Beschreibe sichtbare Entscheidungen

    Nenne Motiv, Platzierung, Komposition, Licht, Material und Stimmung. Weise bei Bild-zu-Bild jeder Referenz eine Aufgabe zu und schreibe, was bleiben und was sich ändern soll.

  3. 03

    Lege Ziel und Budget fest

    Wähle das Seitenverhältnis für die spätere Platzierung, dann 1K, 2K oder 4K und ein, zwei oder vier Ergebnisse. Prüfe vor dem Absenden die angezeigte Gesamtsumme.

  4. 04

    Generiere, prüfe und ändere nur eine Sache

    Vergleiche das Ergebnis in voller Größe mit Briefing und Referenzen. Ändere beim nächsten Versuch zuerst die Anweisung, die das größte Problem verursacht hat, statt alle Variablen neu zu schreiben.

Prüfe die Ausgabe, bevor sie zum finalen Asset wird

Der OpenAI-Leitfaden zur Bilderzeugung weist darauf hin, dass genaue Textplatzierung und Lesbarkeit fehlschlagen können und wiederkehrende Figuren oder Markenelemente zwischen Generierungen abweichen können. Prüfe deshalb auch überzeugend wirkende Ergebnisse in voller Größe gegen Briefing und Vorlagen.

  • Prüfe Text, Logos, Labels, Zahlen und Symbole Zeichen für Zeichen; setze exakte Typografie später in einem Layoutprogramm.
  • Vergleiche Gesichter, Figuren, Produkte und Markenelemente, statt unveränderte Identität oder Struktur anzunehmen.
  • Prüfe Hände, Muster, Reflexionen, Symmetrie, Verbindungen, Maße und kleine Strukturen vor der Veröffentlichung.
  • 4K, mehr Ergebnisse oder mehr Referenzen lösen keine mehrdeutige oder widersprüchliche Anweisung.

Masken, gesperrte Bereiche, exakte Typografie, maßhaltige Geometrie, verlustfreie Restaurierung und compliancekritische Korrekturen gehören in einen klassischen Editor.

Was du vor dem nächsten Versuch ändern kannst

Warum fehlt ein Teil meines ausführlichen Prompts im Bild?

Setze unverzichtbares Motiv, Handlung und Komposition an den Anfang. Streiche schmückende Wörter, die das Bild nicht sichtbar verändern. Wenn ein Prompt gleichzeitig mehrere Personen, Requisiten, Kameraeinstellungen und Stile verlangt, teile ihn in kleinere Versuche. Ändere pro Durchlauf nur eine Sache, damit du erkennst, welche Anweisung das Ergebnis bewegt.

Warum hat sich mein hochgeladenes Bild stärker verändert als gewünscht?

Bild-zu-Bild erstellt eine neue Version, statt nur einzelne Pixel zu ändern. Schreibe zuerst, was bleiben muss, und beschreibe dann eine Hauptänderung. „Flaschenform und Position des Etiketts beibehalten, nur den Hintergrund ersetzen“ ist klarer als eine lange Liste von Stilbegriffen. Bereiche, die exakt gleich bleiben müssen, bearbeitest du abschließend in einem Bildeditor.

Wird das Ergebnis mit mehr Referenzbildern besser?

Beginne mit einer aussagekräftigen Referenz. Füge nur dann eine weitere hinzu, wenn sie eine eigene Aufgabe hat, etwa Pose, Farbwelt, Licht oder Material, und nenne diese Aufgabe im Prompt. Der Arbeitsbereich nimmt bis zu 16 Referenzen an, doch du musst das Limit nicht ausschöpfen. Je mehr Bilder beteiligt sind, desto schwerer lässt sich die Richtung steuern.

Was kann ich tun, wenn Text oder Logo falsch aussehen?

Halte den Text kurz, setze den genauen Wortlaut in Anführungszeichen und streiche Anweisungen, die davon ablenken. Wenn Logo, Label, Preis oder Überschrift stimmen müssen, nutze das generierte Bild für die visuelle Richtung und ergänze die endgültige Schrift in einem Layoutprogramm. Eine höhere Auflösung liefert mehr Pixel, aber keine bessere Rechtschreibung.

Wann lohnen sich die zusätzlichen Credits für 2K oder 4K?

Solange du Motiv, Bildausschnitt oder Prompt änderst, reicht 1K für 10 Credits pro Bild. Wähle 2K für 20 Credits, wenn die Richtung funktioniert und du eine größere Datei brauchst. 4K für 40 Credits ist für konkrete Anforderungen wie Druck, Zuschnitt oder große Displays gedacht. Wenn die Idee noch nicht stimmt, korrigiere sie zuerst in 1K.

Beginne mit einem Prompt oder bringe das Bild mit, das bereits zählt

Öffne Text-zu-Bild, wenn das Briefing die Richtung enthält. Wähle Bild-zu-Bild, wenn Produkt, Motiv, Komposition, Pose oder Stil leichter zu zeigen sind. Beide Links wählen GPT Image 2 aus, starten aber keine Generierung.