Annual billing keeps the same monthly credits for around 30% less.

See Plans

Text zu Bild oder Bild zu Bild: Wo eine Aufgabe beginnt

Text zu Bild oder Bild zu Bild: Wo eine Aufgabe beginnt

Jede Aufgabe beginnt an derselben Weggabelung, und die meisten verschwendeten Credits entstehen daraus, den falschen Ast zu nehmen. Ein Bild aus dem Nichts zu beschreiben und ein Bild zu verändern, das man bereits hat, sind verschiedene Werkzeuge – und das zweite wird zu selten genutzt.

Die Regel

Wenn irgendein Teil des Endbilds bereits existiert – ein Produkt, ein Logo, ein Raum, ein Gesicht, eine Skizze, selbst ein misslungenes Rendering von gestern – beginnen Sie mit Bild zu Bild. Existiert noch nichts, beginnen Sie mit Text zu Bild.

Aufgeschrieben klingt das selbstverständlich. In der Praxis beschreiben Leute ihr eigenes Produkt in Worten einem Modell, das es nie gesehen hat, und verbrauchen dann fünfzehn Renderings beim Versuch, es in die richtige Form zu reden.

Was jeder Modus tatsächlich steuert

Text zu BildBild zu Bild
Sie liefernEine BeschreibungEin oder mehrere Bilder plus eine Beschreibung
Sie steuernMotiv, Stil, BildausschnittAll das, plus die Sache selbst
Versuche bis zum TrefferMehrere, wenn das Motiv konkret istMeist ein bis zwei
ReferenzplätzeKeine1 bis 16, je nach Modell
Am besten fürKonzepte, Szenen, Stimmungen, HintergründeProdukte, Menschen, Markenmaterial, Korrekturen

Beides kostet auf demselben Modell pro Rendering gleich viel. Der Unterschied ist nicht der Preis eines Versuchs, sondern wie viele Versuche Sie brauchen.

Referenzbilder sind der eigentliche Punkt

Wie viele Referenzen ein Modell annimmt, ist ein echter Fähigkeitsunterschied und kein Detail im Datenblatt. Manche Modelle nehmen genau eine. GPT Image 2 und GPT Image 2.5 nehmen bis zu sechzehn. Nano Banana 2 nimmt vierzehn, Nano Banana Pro und Seedream acht bis zehn.

Eine Referenz beantwortet „mach es so wie das hier". Acht Referenzen beantworten „das ist das Produkt, aus diesen Winkeln, in dieser Oberfläche, und so soll das Licht aussehen". Die zweite Frage ist die, die Produktfotografie tatsächlich stellt.

Was in die Plätze gehört

Ein brauchbarer Satz ist: zwei oder drei Winkel des Motivs, ein Bild für Licht oder Stimmung, eins für die Oberfläche oder den Ort. Acht Varianten desselben Winkels helfen nicht. Das Modell mittelt nicht, es bekommt gezeigt, worauf es ankommt.

Die Fälle, die alle falsch machen

Logos und Verpackungen. Ein Modell, das Ihr Logo aus einer Beschreibung zeichnen soll, liefert etwas Logoförmiges und Falsches. Reichen Sie es als Referenz ein, und dasselbe Modell setzt es korrekt.

Dasselbe Produkt, zwölfmal. Produktlistings brauchen Einheitlichkeit mehr als Brillanz. Text zu Bild gibt Ihnen zwölf plausible Flaschen; Bild zu Bild mit festem Referenzsatz gibt Ihnen eine Flasche, zwölffach fotografiert.

„Fast richtig, eine Änderung". Das ist der größte Posten. Wenn ein Rendering zu 90 % sitzt, schreiben Leute den Prompt um und würfeln neu – wodurch alles neu ausgewürfelt wird, auch die Teile, die funktionierten. Das gute Rendering als Referenz zurückzugeben und nur die Änderung zu beschreiben, bewahrt, was Ihnen gefiel.

Hintergründe. Ein Motiv freizustellen und woanders hinzusetzen ist kein Generierungsproblem. Hintergrundentferner, transparenter Hintergrund und Hintergrundfarbe erledigen das, ohne das Motiv überhaupt anzufassen.

Wann Text zu Bild wirklich richtig ist

Hintergründe und Umgebungen, in die Sie später montieren. Konzeptarbeit, bei der es darum geht, Optionen zu sehen. Illustration und stilisierte Kunst ohne realen Bezugspunkt. Alles, wo „überrasch mich" ein Merkmal ist und kein Risiko.

Es ist außerdem der günstigere Ort zum Erkunden. Genau dafür gibt es die 2-Credit-Modelle: sechs Bildausschnitte einer Idee durchlaufen lassen, einen wählen, und erst dann Referenzen und ein besseres Modell zur Ausführung holen.

Ein hybrider Ablauf, der funktioniert

Die meisten fertigen Bilder auf dieser Plattform entstehen aus einer Schleife, nicht aus einem einzelnen Prompt. Komposition mit Text zu Bild auf einem billigen Modell entwerfen. Das beste Bild wählen. Zu Bild zu Bild wechseln, dieses Bild zusammen mit dem echten Produkt als Referenz einspeisen und nur beschreiben, was sich ändern soll. Das Finale auf dem Modell rendern, das zum Bestimmungsort passt.

Zwei oder drei solcher Durchgänge schlagen zwölf Neuwürfe und kosten weniger. Wiederholbare Ergebnisse behandelt die Parameterseite derselben Schleife – Seeds, Guidance und was sich zwischen Läufen zu fixieren lohnt.

Mitten in der Arbeit wechseln, ohne neu anzufangen

Im Arbeitsbereich ist das Prompt-Feld in beiden Modi identisch; ein Referenzbild hinzuzufügen ist das, was Sie von einem in den anderen bringt. An Ihrem Prompt muss nichts umgeschrieben werden, und die Modellliste bleibt dieselbe, sodass ein bereits angestellter Vergleich weiter gilt.

Neunzehn Modelle unterstützen beide Modi, mit unterschiedlichen Referenzgrenzen. Der Katalog listet sie auf, und die Preise gelten pro Rendering, unabhängig vom Modus – das Einzige, was die Wahl also ändert, ist die Zahl der nötigen Renderings. Und das ist meist das gesamte Budget.

Dieselbe Aufgabe, beide Wege

Ein konkreter Vergleich. Sie haben ein Foto einer Keramikflasche und brauchen drei Bilder: eine Listing-Aufnahme auf Weiß, eine Küchenszene und ein breites Banner.

VorgehenSchritteErgebnis
Nur Text zu BildDie Flasche jedes Mal beschreiben; neu würfeln, bis die Form passtDrei verschiedene Flaschen, keine davon Ihre
Bild zu BildDas Foto als Referenz geben; nur Umgebung und Format beschreibenEine Flasche, drei Umgebungen, einheitlich

Der zweite Weg ist auch schneller fertig, weil jedes Bild in ein bis zwei Versuchen sitzt statt in fünf. Die Credits pro Rendering sind identisch; die Summe ist es nicht annähernd.

Fehlerbilder, die man erkennen sollte

Das driftende Motiv. Ihr Produkt ändert zwischen Renderings die Form. Entweder Sie sind in Text zu Bild, wo Sie es nicht sein sollten, oder die Strength ist hoch genug, dass das Modell die Referenz neu deuten darf.

Die Collage. Zu viele unzusammenhängende Referenzen ergeben ein Bild, das sie mittelt. Fünf Referenzen mit verschiedenen Aufgaben – Winkel, Winkel, Licht, Oberfläche, Stimmung – funktionieren; zwölf ähnliche nicht.

Der überschriebene Treffer. Ein Rendering ist fast perfekt, Sie schreiben den Prompt um, und die gute Fassung ist weg. Geben Sie das gute Rendering als Referenz zurück und beschreiben Sie nur die Änderung.

Der Prompt, der ein Werkzeug hätte sein sollen. „Dasselbe Bild, aber mit weißem Hintergrund" kostet ein volles Rendering, während ein Werkzeug es erledigt, ohne das Motiv anzufassen.

Welche Modelle zu welchem Modus passen

Bei Text zu Bild zählen die billigen schnellen Maschinen am meisten, denn beim Erkunden häufen sich die Versuche. Bei Bild zu Bild entscheidet die Referenzgrenze, was möglich ist: ein Platz genügt für einen Stiltransfer, aber Produktarbeit mit mehreren Winkeln braucht acht oder mehr.

Die Modellseiten nennen beide Zahlen, und der Katalog zeigt sie nebeneinander. Sonst muss sich an Ihrem Ablauf zwischen den Modi nichts ändern – derselbe Prompt, dieselben Formateinstellungen, dasselbe Gespür.