Wenn du schon gesucht hast, wie man in Gemini Bilder erzeugt, bist du wahrscheinlich auf ein Namenswirrwarr gestoßen: Nano Banana, Nano Banana 2, Nano Banana Pro, Gemini 3.1 Flash Image. Sie wirken wie unterschiedliche Produkte, sind es aber nicht — Nano Banana ist einfach der Name der nativen Bilderzeugung von Gemini, und die anderen sind Versionen davon.

Diese Klärung ist wichtig, weil die Modellwahl die Entscheidung ist, die das Ergebnis am meisten beeinflusst. Eine Infografik mit dichtem Text im schnellen Modell erzeugt kommt mit schiefen Buchstaben heraus; dieselbe Anfrage im Pro-Modell kommt lesbar heraus. Zu wissen, welches wann zu nutzen ist, spart Versuche und tägliches Kontingent.

Dieser Guide deckt die drei Modelle ab und wann man welches nutzt, die Schritt-für-Schritt-Erzeugung, wie man Prompts so schreibt, dass Gemini sie am besten nutzt, die konversationelle Bearbeitung, die das Hauptmerkmal des Tools ist, und die realen Grenzen.

Was Nano Banana ist

Nano Banana ist der Name der nativen Fähigkeit von Gemini, Bilder zu erzeugen und zu bearbeiten. Nativ bedeutet, dass das Bildmodell in Gemini selbst integriert ist und nicht als separates System angesteuert wird — es versteht die Anfrage im selben Kontext der Unterhaltung, einschließlich gesendeter Bilder und dessen, was zuvor gesagt wurde.

Im Februar 2026 wurde Nano Banana 2 zum Standardweg der Bilderzeugung auf den wichtigsten Google-Oberflächen, einschließlich der Gemini-App. Nano Banana Pro existiert weiterhin als Option mit hoher Genauigkeit, hauptsächlich für Nutzer mit bezahltem Plan.

Die drei Modelle und wann man welches nutzt

Im Gemini-Modellmenü erscheinen Verhaltensbezeichnungen — Schnell, Denken und Pro. Dahinter stehen drei unterschiedliche Modelle.

ModellProfilNutze es wenn
Nano Banana 2 Lite (Schnell)Das schnellste und sparsamsteTests, schnelle Varianten, einfache Bilder mit nur einer Szene
Nano Banana 2 (Denken)Der Generalist, Standard für fast allesDie meisten Fälle: Szenen, Porträts, Produkte, Illustrationen
Nano Banana ProHohe Genauigkeit, Text und komplexes LayoutInfografiken, Poster mit dichtem Text, Produktionsstücke

Eine nützliche Eigenschaft des Ablaufs: Du kannst zunächst mit dem Standardmodell erzeugen und, falls das Ergebnis mehr Detail verlangt, dasselbe Bild mit Pro neu erzeugen. In den bezahlten Plänen erscheint die Option im Dreipunkt-Menü des erzeugten Bildes als "Mit Pro neu erzeugen". Die Einschränkung: Ist das tägliche Kontingent des Standardmodells aufgebraucht, ist auch die Neuerzeugung mit Pro nicht mehr verfügbar.

💡 Kontingent-Strategie: Nutze das schnelle Modell, um die funktionierende Komposition zu finden, und erzeuge erst dann mit Pro neu. Die Generierungen des teureren Modells für Tests zu verbrauchen ist der Fehler, der das tägliche Kontingent am meisten verschwendet.

So erzeugst du dein erstes Bild

  1. Öffne Gemini. Am Computer über den Browser, am Handy über die App.
  2. Geh in den Bilderbereich. In der Seitenleiste gibt es einen Bilder-Bereich; alternativ findet sich im Werkzeugmenü die Option, Bilder zu erstellen.
  3. Wähle das Modell. Schnell, Denken oder Pro, gemäß obiger Tabelle. Bist du unsicher, beginne mit dem Standard.
  4. Schreibe die Anfrage in natürlicher Sprache. Vollständige Sätze funktionieren besser als mit Kommas getrennte Wortlisten.
  5. Fordere Anpassungen in derselben Unterhaltung an. "Mach den Hintergrund dunkler", "wechsle zum späten Nachmittag", "entferne die Pflanze in der Ecke". Das Bild bleibt erhalten und nur das Verlangte ändert sich.
  6. Lade in voller Auflösung herunter. Nutze den Download-Button, niemals einen Screenshot.

Auflösung: was du herunterladen kannst

Die Download-Auflösung hängt vom Plan ab. Ohne bezahlten Google-KI-Plan erfolgt der Download in 1K. Mit Plan lässt sich in 2K herunterladen. Nano Banana Pro ist der Weg zu Ausgaben höherer Genauigkeit, einschließlich Material mit Text und Layout, das eine Vergrößerung aushalten muss.

In der Praxis bedeutet das: Für übliche digitale Nutzung — Post, Thumbnail, Blogbild, Präsentation — reicht das, was Gemini liefert, bereits aus. Für großformatigen Druck oder hochauflösende Monitore musst du nach der Erzeugung vergrößern. Man kann die Bildauflösung ohne Qualitätsverlust erhöhen, und das Ergebnis ist meist gut, wenn das Bild sauber und wenig detailliert ist.

So schreibst du Prompts für Gemini

Google selbst schlägt eine einfache Ausgangsformel vor: Verlange die Erstellung eines Bildes mit Angabe von Subjekt, Aktion und Szene. Guter Ausgangspunkt — und der nächste Schritt ist genau, sie zu erweitern.

Beginne mit der Formel, dann verfeinere

Eine minimale Anfrage würde so aussehen:

Erstelle das Bild einer Katze, die in einem Sonnenstrahl auf einem Fensterbrett döst.

Das liefert bereits ein Ergebnis. Aber jede zusätzliche Schicht bringt das Ergebnis näher an das, was du dir vorgestellt hast:

Erstelle das Bild einer schwarzen Katze, die zusammengerollt in einem Sonnenstrahl auf einem hölzernen Fensterbrett döst, ein Leinenvorhang daneben schwingt leicht, sichtbarer Staub schwebt im Licht, seitliche Halbtotale, warmes Licht am späten Nachmittag, beige und Bernsteintöne, kontemplative Haus-Fotografie.

Schreibe in Fließtext, nicht in Tags

Das ist der wichtigste Unterschied zu Tools wie Midjourney. Gemini ist konversationell und nutzt vollständige Sätze besser als mit Kommas getrennte Begriffslisten. Schreibe, als würdest du die Szene jemandem erklären.

Nenne das Seitenverhältnis

Gibst du es nicht an, wählt das Modell selbst. Sag "vertikales Format für Stories", "quadratisch für Instagram", "horizontales Breitbild" oder das Verhältnis direkt.

Setze Text in Anführungszeichen

Wenn das Bild Wörter enthalten muss, schreibe sie wörtlich in Anführungszeichen und gib die Position an. Ohne das kann das Modell umformulieren oder nach Belieben platzieren.

Iteriere, statt neu zu schreiben

Ist etwas schiefgegangen, verlange die spezifische Korrektur, statt alles neu zu schreiben. "Behalte die Komposition und ändere nur die Jackenfarbe zu Grün" bewahrt, was schon gut war. Den ganzen Prompt neu zu schreiben erzeugt ein neues Bild ohne Bezug zum vorherigen.

Konversationelle Bearbeitung: das Hauptmerkmal

Hier glänzt Gemini. Du sendest ein Bild — von ihm erzeugt oder eigenes — und beschreibst die Änderung in Worten, ohne Maske, Ebene oder Auswahl.

Hintergrund tauschen

Das Subjekt beibehalten und die Umgebung dahinter ersetzen. Nützlich für Porträts, Produkte und Marketingmaterial.

Behalte die Person exakt so, wie sie ist, und ersetze den Hintergrund durch eine helle Sichtbetonwand, mit diffusem natürlichem Licht von links. Bewahre die Beleuchtung auf dem Gesicht.

Stimmung und Tageszeit ändern

Einen sonnigen Tag in Nacht verwandeln, Regen hinzufügen, Herbst gegen Winter tauschen. Dieselbe Szene mit anderer Atmosphäre.

Behalte die Komposition und alle Elemente. Ändere von sonnigem Tag zu regnerischer Nacht, mit der nassen Straße, die die Lichter reflektiert, und tiefliegendem Nebel.

Kamerawinkel ändern

Verlange dieselbe Szene aus einem anderen Blickpunkt. Nicht perfekt, weil das Modell erfinden muss, was nicht sichtbar war, aber funktioniert gut bei Szenen mit Raum.

Zeige dieselbe Szene aus einem niedrigeren Winkel, nah am Boden, mit denselben Objekten, derselben Beleuchtung und demselben Stil.

Stil aus einer Referenz übertragen

Eine der nützlichsten und am wenigsten bekannten Funktionen: zwei Bilder senden und verlangen, dass Textur, Farbe oder Stil des einen auf das andere angewendet werden. Der schnellste Weg, Ästhetiken zu testen, ohne von vorne zu beginnen.

Wende die Farbpalette und Textur des zweiten Bildes auf das erste an, während Komposition, Objekte und Bildausschnitt des ersten exakt gleich bleiben.

Elemente hinzufügen oder entfernen

Ein unerwünschtes Objekt entfernen, eine Pflanze hinzufügen, eine Person im Hintergrund einfügen. Funktioniert gut bei klar abgegrenzten Elementen; Entfernungen in Bereichen mit komplexer Textur hinterlassen manchmal Spuren.

Entferne das rechts geparkte Auto und vervollständige die Straße natürlich, während der Rest des Bildes unverändert bleibt.

Mit Referenzbildern arbeiten

Bilder zusammen mit der Anfrage zu senden ist der Bereich, in dem Gemini am stärksten ist, und es lohnt sich, die drei Nutzungsformen zu verstehen.

Subjektreferenz. Du sendest das Foto einer Person, eines Produkts oder Charakters und verlangst, dass er in einer neuen Szene erscheint. Das Modell versucht, die Identität des Subjekts zu bewahren und alles andere zu tauschen.

Stilreferenz. Du sendest ein Bild, dessen Ästhetik du reproduzieren willst, und verlangst, dass Palette, Textur oder visuelle Sprache auf ein anderes Bild oder eine in Text beschriebene Szene angewendet werden.

Kompositionsreferenz. Du sendest eine Skizze, ein schlecht aufgenommenes Foto oder einen Entwurf und verlangst, dass daraus ein fertiges Bild wird, das die Anordnung der Elemente beibehält.

Ein praktischer Hinweis: Je sauberer die Referenz, desto besser das Ergebnis. Bilder mit unaufgeräumtem Hintergrund lassen das Modell Elemente der Szenerie übernehmen, die du nicht verlangt hast. Hat deine Referenz dieses Problem, verbessert den Hintergrund zu entfernen vor dem Senden das Ergebnis deutlich.

Text und Infografiken

Lesbares Text-Rendering ist einer der sichtbarsten Fortschritte dieser Modellgeneration, und genau hier rechtfertigt sich Nano Banana Pro. Poster mit Titel und Untertitel, Infografik mit Labels, Diagramm aus Notizen, Cover mit Markennamen — all das kam bis vor kurzem verzerrt heraus und ist jetzt bei den meisten Versuchen sauber.

Drei Dinge verbessern das Ergebnis mit Text deutlich:

Trotzdem bleibt für Stücke, bei denen die Typografie der Marke entsprechen muss, der zuverlässigste Weg, das Bild ohne Text zu erzeugen und den Text danach mit der richtigen Schrift hinzuzufügen.

Acht fertige Anfragen für den Alltag

Vorlagen, die die häufigsten Bedürfnisse abdecken. Ersetze, was in eckigen Klammern steht, und behalte den Rest bei.

Titelbild für Artikel

Erstelle ein horizontales Breitbild über [Thema], mit sauberer Komposition, einem zentralen Element im Fokus und leerer linker Seite für Text. Weiches natürliches Licht, Palette in [Farbe]-Tönen und Neutraltönen, ohne Text im Bild.

Quadratischer Post für soziale Netzwerke

Erstelle ein quadratisches Bild von [Motiv] mit minimalistischer Ästhetik, glattem Hintergrund in [Farbe], weichem Schatten und viel Negativraum um das Objekt. Gleichmäßiges diffuses Licht, hoher Kontrast zwischen Objekt und Hintergrund, kein Text.

Poster mit Titel

Erstelle ein vertikales Werbeposter für [Ereignis]. Titel "[genauer Text]" in großen Buchstaben oben und darunter kleiner: "[genauer Text]". Hintergrund in [Farbe] mit einfachem grafischem Element. Redaktioneller Stil, serifenlose Typografie, viel Leerraum.

Hintergrund eines Fotos tauschen

Behalte die Person exakt so, wie sie ist, ohne Gesicht, Haare oder Kleidung zu ändern. Ersetze nur den Hintergrund durch [Beschreibung der Szenerie], mit derselben Lichtrichtung, die auf sie fällt.

Stilvariante

Behalte dieselbe Komposition, dieselben Elemente und denselben Bildausschnitt, aber erzeuge das Bild im Stil [Aquarell / Vektorillustration / realistische Fotografie] neu, mit Palette [Beschreibung].

Produktmockup

Erstelle ein Produktfoto von [Produkt] auf [Oberfläche], Hintergrund [Farbe] mit weichem Verlauf, Studiobeleuchtung mit seitlicher Softbox, leicht erhöhter Frontalwinkel, kontrollierte Reflexion, hohe Schärfe, ohne Text oder Etikett.

Einfache Infografik

Erstelle eine horizontale Infografik mit drei gleichen Spalten, die [Thema] erklären. Jede Spalte hat oben ein einfaches Icon, einen kurzen Titel und einen unterstützenden Satz. Die Titel sind "[Text]", "[Text]" und "[Text]". Palette in [zwei Farben], sauberer redaktioneller Stil, ohne Schatten.

Ein Foto bereinigen

Entferne [unerwünschtes Element] aus dem Bild und vervollständige den Bereich natürlich, während der Rest ohne Änderungen bleibt, mit derselben Beleuchtung und demselben Detailniveau.

Charakterkonsistenz in Gemini

Da die Bearbeitung konversationell ist, ist die effektivste Methode auch die einfachste: im selben Gesprächsfaden bleiben. Nach der Erzeugung des Charakters verlange die nächsten Szenen, ohne ihn neu zu beschreiben — "zeig jetzt denselben Charakter in einem Café sitzend" — und der angesammelte Kontext erledigt die Arbeit.

Ist die Serie lang oder musst du an einem anderen Tag weitermachen, nutze das Bild als Subjektreferenz und behalte eine feste Beschreibung der dauerhaften Merkmale bei, Wort für Wort wiederholt. Der Guide zur Charakterkonsistenz mit KI beschreibt die vier Methoden im Detail und wann sich welche lohnt.

Gemini oder ChatGPT: was sich in der Praxis unterscheidet

AspektGeminiChatGPT
Prompt-StilKonversationeller FließtextKonversationeller Fließtext
Bearbeitung per KonversationStark, mit guter Bewahrung des OriginalsStark, mit guter Bewahrung des Originals
Mehrere EingabebilderStärke, einschließlich StilübertragungUnterstützt
Text im BildSehr gut, noch besser im Pro-ModellSehr gut
ModellwahlExplizit: Schnell, Denken oder ProSofort oder Denken, je nach Plan
Download-Auflösung1K kostenlos, 2K mit PlanBis zu 2K

Die beiden Tools sind sich stark angenähert. Das praktische Kriterium ist, dieselbe Anfrage bei beiden zu testen und zu vergleichen — und das zu nutzen, das bei deinem Bildtyp besser abschneidet. Der ChatGPT-Guide zum Bilder erstellen deckt die andere Seite im Detail ab, und der Vergleich der besten KIs zum Bilder erstellen stellt die wichtigsten Optionen nebeneinander.

Was Gemini noch nicht gut kann

Sieben Fehler, die am meisten stören

  1. Das Pro-Modell zum Testen nutzen. Verbraucht Kontingent, das für die finale Version fehlen würde.
  2. Im Tag-Format schreiben. Eine Wortliste ist die Sprache anderer Tools; hier bringt Fließtext mehr.
  3. Das Seitenverhältnis nicht nennen. Ohne Angabe ist das Format fast nie das, was du brauchst.
  4. Den Prompt bei jedem Versuch neu schreiben. Du verlierst, was bereits stimmte. Verlange gezielte Korrekturen.
  5. Eine Referenz mit unaufgeräumtem Hintergrund senden. Das Modell übernimmt Elemente der Szenerie, die du nicht verlangt hast.
  6. Per Screenshot speichern. Verliert Auflösung und fügt erneute Komprimierung hinzu.
  7. Ohne Optimierung veröffentlichen. 2K-Bilder sind schwer und verlangsamen jede Seite beim Laden.

Nach der Erzeugung: das Bild vorbereiten

Das Bild, das aus Gemini kommt, ist bereit zum Betrachten, nicht zum Veröffentlichen. Vier Schritte lösen das.

Format konvertieren. PNG ist großartig für Transparenz und schlecht für Fotos im Web. Für Websites reduziert WebP das Gewicht meist um die Hälfte ohne sichtbaren Unterschied; für normalen Versand reicht JPG. Der Bildkonverter erledigt den Wechsel im Browser, und der Guide zu Bildformaten hilft bei der Wahl.

Gewicht reduzieren. Ein 2K-Bild liegt leicht über mehreren Megabyte. Der Bildkompressor schneidet einen Großteil davon ohne sichtbaren Verlust ab.

Größe und Bildausschnitt anpassen. Für eine bestimmte Größe nutze den Größenänderer; stimmt das Seitenverhältnis nicht, bewahrt Zuschneiden mehr Qualität als Strecken.

Motiv bei Bedarf isolieren. Für Produkte, Logos und Elemente auf farbigem Hintergrund liefert den Hintergrund zu entfernen das transparente PNG, das die Erzeugung nicht liefert.

💡 Reihenfolge, die funktioniert: in voller Auflösung herunterladen → zuschneiden oder Größe ändern → Format konvertieren → zuletzt komprimieren. Vor dem Größenändern zu komprimieren verschwendet Qualität.

Checkliste vor der Erzeugung

Konvertiere deine Bilder ins richtige Format

Verwandle das schwere PNG von Gemini in WebP oder JPG und mach das Bild veröffentlichungsbereit, direkt im Browser.

Bild konvertieren

Häufig gestellte Fragen

Was ist Nano Banana und was hat es mit Gemini zu tun?
Nano Banana ist der Name der nativen Bilderzeugung von Gemini — kein separates Produkt und keine eigenständige App. Aktuell gibt es drei Modelle in der Familie: Lite, ausgerichtet auf Geschwindigkeit und Kosten, Nano Banana 2, seit Februar 2026 der generalistische Standard, und Nano Banana Pro mit hoher Genauigkeit, geeignet für dichten Text und komplexe Layouts. In der App erscheinen sie im Menü als Schnell, Denken und Pro.
Kann man mit Gemini kostenlos Bilder erstellen?
Ja, mit Einschränkungen. Die kostenlose Nutzung hat ein tägliches Erzeugungskontingent, und der Download erfolgt in 1K-Auflösung. Mit bezahltem Google-KI-Plan steigt der Download auf 2K, und die Option, das Bild mit Nano Banana Pro neu zu erzeugen, wird verfügbar. Ein praktisches Detail, das viele überrascht: Ist das tägliche Kontingent des Standardmodells aufgebraucht, funktioniert auch die Neuerzeugung mit Pro nicht mehr, selbst mit Plan.
Welches Modell für welchen Bildtyp wählen?
Für die meisten Fälle — Szenen, Porträts, Produkte, Illustrationen — reicht das Standardmodell gut aus. Das schnelle Modell dient zum Erkunden von Kompositionen und Erzeugen von Varianten, ohne Kontingent des teureren zu verbrauchen. Pro lohnt sich, wenn die Anfrage dichten Text, Infografik, Diagramm, Poster mit typografischer Hierarchie oder ein Produktionsstück umfasst. Die sparsamste Strategie ist, mit dem schnellen zu testen und nur die gewählte Version mit Pro neu zu erzeugen.
Wie bearbeite ich ein eigenes Foto in Gemini?
Sende das Bild in der Unterhaltung und beschreibe die Änderung in natürlicher Sprache — Hintergrund tauschen, Beleuchtung ändern, ein Objekt entfernen, einen anderen Stil anwenden. Maske oder Auswahl sind nicht nötig. Wichtig zu wissen: Das Ergebnis ist ein neues Bild, das aus deinem erzeugt wird, keine pixelgenaue Bearbeitung des Originals: Die Komposition bleibt erhalten, aber feine Details des Originals ändern sich. Für Änderungen, die absolute Genauigkeit verlangen, ist ein klassischer Editor weiterhin besser geeignet.
Wie bekomme ich einen transparenten Hintergrund?
Selbst bei ausdrücklicher Bitte kommt das Bild meist mit einem soliden statt einem echten transparenten Hintergrund. Der schnellste Weg ist, um einen glatten weißen Hintergrund zu bitten, der sich am leichtesten freistellen lässt, und die Transparenz danach durch Entfernen des Hintergrunds und Speichern als PNG zu erzeugen. Beim Modell auf echter Transparenz zu bestehen führt meist zu einem gezeichneten Schachbrett-Hintergrund als Imitation, der nichts nützt.
Darf ich die erzeugten Bilder kommerziell nutzen?
Die Regeln hängen vom Plan, vom Land und den aktuellen Google-Bedingungen ab und können sich ändern. Zudem ist die Erlaubnis zur kommerziellen Nutzung nicht dasselbe wie rechtlicher Schutz: In mehreren Rechtsordnungen stoßen vollständig maschinell erzeugte Werke auf Einschränkungen bei der Urheberrechtsregistrierung. Prüfe vor der Verwendung in Kundenmaterial oder verkäuflichen Produkten die aktuellen Bedingungen und vermeide Anfragen mit eingetragenen Marken, lizenzierten Figuren oder realen Personen.