Wenn du schon gesucht hast, wie man in Gemini Bilder erzeugt, bist du wahrscheinlich auf ein Namenswirrwarr gestoßen: Nano Banana, Nano Banana 2, Nano Banana Pro, Gemini 3.1 Flash Image. Sie wirken wie unterschiedliche Produkte, sind es aber nicht — Nano Banana ist einfach der Name der nativen Bilderzeugung von Gemini, und die anderen sind Versionen davon.
Diese Klärung ist wichtig, weil die Modellwahl die Entscheidung ist, die das Ergebnis am meisten beeinflusst. Eine Infografik mit dichtem Text im schnellen Modell erzeugt kommt mit schiefen Buchstaben heraus; dieselbe Anfrage im Pro-Modell kommt lesbar heraus. Zu wissen, welches wann zu nutzen ist, spart Versuche und tägliches Kontingent.
Dieser Guide deckt die drei Modelle ab und wann man welches nutzt, die Schritt-für-Schritt-Erzeugung, wie man Prompts so schreibt, dass Gemini sie am besten nutzt, die konversationelle Bearbeitung, die das Hauptmerkmal des Tools ist, und die realen Grenzen.
Was Nano Banana ist
Nano Banana ist der Name der nativen Fähigkeit von Gemini, Bilder zu erzeugen und zu bearbeiten. Nativ bedeutet, dass das Bildmodell in Gemini selbst integriert ist und nicht als separates System angesteuert wird — es versteht die Anfrage im selben Kontext der Unterhaltung, einschließlich gesendeter Bilder und dessen, was zuvor gesagt wurde.
Im Februar 2026 wurde Nano Banana 2 zum Standardweg der Bilderzeugung auf den wichtigsten Google-Oberflächen, einschließlich der Gemini-App. Nano Banana Pro existiert weiterhin als Option mit hoher Genauigkeit, hauptsächlich für Nutzer mit bezahltem Plan.
Die drei Modelle und wann man welches nutzt
Im Gemini-Modellmenü erscheinen Verhaltensbezeichnungen — Schnell, Denken und Pro. Dahinter stehen drei unterschiedliche Modelle.
| Modell | Profil | Nutze es wenn |
|---|---|---|
| Nano Banana 2 Lite (Schnell) | Das schnellste und sparsamste | Tests, schnelle Varianten, einfache Bilder mit nur einer Szene |
| Nano Banana 2 (Denken) | Der Generalist, Standard für fast alles | Die meisten Fälle: Szenen, Porträts, Produkte, Illustrationen |
| Nano Banana Pro | Hohe Genauigkeit, Text und komplexes Layout | Infografiken, Poster mit dichtem Text, Produktionsstücke |
Eine nützliche Eigenschaft des Ablaufs: Du kannst zunächst mit dem Standardmodell erzeugen und, falls das Ergebnis mehr Detail verlangt, dasselbe Bild mit Pro neu erzeugen. In den bezahlten Plänen erscheint die Option im Dreipunkt-Menü des erzeugten Bildes als "Mit Pro neu erzeugen". Die Einschränkung: Ist das tägliche Kontingent des Standardmodells aufgebraucht, ist auch die Neuerzeugung mit Pro nicht mehr verfügbar.
💡 Kontingent-Strategie: Nutze das schnelle Modell, um die funktionierende Komposition zu finden, und erzeuge erst dann mit Pro neu. Die Generierungen des teureren Modells für Tests zu verbrauchen ist der Fehler, der das tägliche Kontingent am meisten verschwendet.
So erzeugst du dein erstes Bild
- Öffne Gemini. Am Computer über den Browser, am Handy über die App.
- Geh in den Bilderbereich. In der Seitenleiste gibt es einen Bilder-Bereich; alternativ findet sich im Werkzeugmenü die Option, Bilder zu erstellen.
- Wähle das Modell. Schnell, Denken oder Pro, gemäß obiger Tabelle. Bist du unsicher, beginne mit dem Standard.
- Schreibe die Anfrage in natürlicher Sprache. Vollständige Sätze funktionieren besser als mit Kommas getrennte Wortlisten.
- Fordere Anpassungen in derselben Unterhaltung an. "Mach den Hintergrund dunkler", "wechsle zum späten Nachmittag", "entferne die Pflanze in der Ecke". Das Bild bleibt erhalten und nur das Verlangte ändert sich.
- Lade in voller Auflösung herunter. Nutze den Download-Button, niemals einen Screenshot.
Auflösung: was du herunterladen kannst
Die Download-Auflösung hängt vom Plan ab. Ohne bezahlten Google-KI-Plan erfolgt der Download in 1K. Mit Plan lässt sich in 2K herunterladen. Nano Banana Pro ist der Weg zu Ausgaben höherer Genauigkeit, einschließlich Material mit Text und Layout, das eine Vergrößerung aushalten muss.
In der Praxis bedeutet das: Für übliche digitale Nutzung — Post, Thumbnail, Blogbild, Präsentation — reicht das, was Gemini liefert, bereits aus. Für großformatigen Druck oder hochauflösende Monitore musst du nach der Erzeugung vergrößern. Man kann die Bildauflösung ohne Qualitätsverlust erhöhen, und das Ergebnis ist meist gut, wenn das Bild sauber und wenig detailliert ist.
So schreibst du Prompts für Gemini
Google selbst schlägt eine einfache Ausgangsformel vor: Verlange die Erstellung eines Bildes mit Angabe von Subjekt, Aktion und Szene. Guter Ausgangspunkt — und der nächste Schritt ist genau, sie zu erweitern.
Beginne mit der Formel, dann verfeinere
Eine minimale Anfrage würde so aussehen:
Das liefert bereits ein Ergebnis. Aber jede zusätzliche Schicht bringt das Ergebnis näher an das, was du dir vorgestellt hast:
Schreibe in Fließtext, nicht in Tags
Das ist der wichtigste Unterschied zu Tools wie Midjourney. Gemini ist konversationell und nutzt vollständige Sätze besser als mit Kommas getrennte Begriffslisten. Schreibe, als würdest du die Szene jemandem erklären.
Nenne das Seitenverhältnis
Gibst du es nicht an, wählt das Modell selbst. Sag "vertikales Format für Stories", "quadratisch für Instagram", "horizontales Breitbild" oder das Verhältnis direkt.
Setze Text in Anführungszeichen
Wenn das Bild Wörter enthalten muss, schreibe sie wörtlich in Anführungszeichen und gib die Position an. Ohne das kann das Modell umformulieren oder nach Belieben platzieren.
Iteriere, statt neu zu schreiben
Ist etwas schiefgegangen, verlange die spezifische Korrektur, statt alles neu zu schreiben. "Behalte die Komposition und ändere nur die Jackenfarbe zu Grün" bewahrt, was schon gut war. Den ganzen Prompt neu zu schreiben erzeugt ein neues Bild ohne Bezug zum vorherigen.
Konversationelle Bearbeitung: das Hauptmerkmal
Hier glänzt Gemini. Du sendest ein Bild — von ihm erzeugt oder eigenes — und beschreibst die Änderung in Worten, ohne Maske, Ebene oder Auswahl.
Hintergrund tauschen
Das Subjekt beibehalten und die Umgebung dahinter ersetzen. Nützlich für Porträts, Produkte und Marketingmaterial.
Stimmung und Tageszeit ändern
Einen sonnigen Tag in Nacht verwandeln, Regen hinzufügen, Herbst gegen Winter tauschen. Dieselbe Szene mit anderer Atmosphäre.
Kamerawinkel ändern
Verlange dieselbe Szene aus einem anderen Blickpunkt. Nicht perfekt, weil das Modell erfinden muss, was nicht sichtbar war, aber funktioniert gut bei Szenen mit Raum.
Stil aus einer Referenz übertragen
Eine der nützlichsten und am wenigsten bekannten Funktionen: zwei Bilder senden und verlangen, dass Textur, Farbe oder Stil des einen auf das andere angewendet werden. Der schnellste Weg, Ästhetiken zu testen, ohne von vorne zu beginnen.
Elemente hinzufügen oder entfernen
Ein unerwünschtes Objekt entfernen, eine Pflanze hinzufügen, eine Person im Hintergrund einfügen. Funktioniert gut bei klar abgegrenzten Elementen; Entfernungen in Bereichen mit komplexer Textur hinterlassen manchmal Spuren.
Mit Referenzbildern arbeiten
Bilder zusammen mit der Anfrage zu senden ist der Bereich, in dem Gemini am stärksten ist, und es lohnt sich, die drei Nutzungsformen zu verstehen.
Subjektreferenz. Du sendest das Foto einer Person, eines Produkts oder Charakters und verlangst, dass er in einer neuen Szene erscheint. Das Modell versucht, die Identität des Subjekts zu bewahren und alles andere zu tauschen.
Stilreferenz. Du sendest ein Bild, dessen Ästhetik du reproduzieren willst, und verlangst, dass Palette, Textur oder visuelle Sprache auf ein anderes Bild oder eine in Text beschriebene Szene angewendet werden.
Kompositionsreferenz. Du sendest eine Skizze, ein schlecht aufgenommenes Foto oder einen Entwurf und verlangst, dass daraus ein fertiges Bild wird, das die Anordnung der Elemente beibehält.
Ein praktischer Hinweis: Je sauberer die Referenz, desto besser das Ergebnis. Bilder mit unaufgeräumtem Hintergrund lassen das Modell Elemente der Szenerie übernehmen, die du nicht verlangt hast. Hat deine Referenz dieses Problem, verbessert den Hintergrund zu entfernen vor dem Senden das Ergebnis deutlich.
Text und Infografiken
Lesbares Text-Rendering ist einer der sichtbarsten Fortschritte dieser Modellgeneration, und genau hier rechtfertigt sich Nano Banana Pro. Poster mit Titel und Untertitel, Infografik mit Labels, Diagramm aus Notizen, Cover mit Markennamen — all das kam bis vor kurzem verzerrt heraus und ist jetzt bei den meisten Versuchen sauber.
Drei Dinge verbessern das Ergebnis mit Text deutlich:
- Den genauen Text in Anführungszeichen schreiben. Ohne das interpretiert das Modell das Wort als Thema und kann es umformulieren.
- Die Hierarchie beschreiben. "Großer Titel oben, kleinerer Untertitel darunter, drei kurze Textblöcke unten" gibt deutlich mehr Kontrolle, als es offen zu lassen.
- Das Pro-Modell nutzen. Dichtes Layout und kleiner Text sind genau der Fall, in dem der Unterschied zwischen den Modellen sichtbar wird.
Trotzdem bleibt für Stücke, bei denen die Typografie der Marke entsprechen muss, der zuverlässigste Weg, das Bild ohne Text zu erzeugen und den Text danach mit der richtigen Schrift hinzuzufügen.
Acht fertige Anfragen für den Alltag
Vorlagen, die die häufigsten Bedürfnisse abdecken. Ersetze, was in eckigen Klammern steht, und behalte den Rest bei.
Titelbild für Artikel
Quadratischer Post für soziale Netzwerke
Poster mit Titel
Hintergrund eines Fotos tauschen
Stilvariante
Produktmockup
Einfache Infografik
Ein Foto bereinigen
Charakterkonsistenz in Gemini
Da die Bearbeitung konversationell ist, ist die effektivste Methode auch die einfachste: im selben Gesprächsfaden bleiben. Nach der Erzeugung des Charakters verlange die nächsten Szenen, ohne ihn neu zu beschreiben — "zeig jetzt denselben Charakter in einem Café sitzend" — und der angesammelte Kontext erledigt die Arbeit.
Ist die Serie lang oder musst du an einem anderen Tag weitermachen, nutze das Bild als Subjektreferenz und behalte eine feste Beschreibung der dauerhaften Merkmale bei, Wort für Wort wiederholt. Der Guide zur Charakterkonsistenz mit KI beschreibt die vier Methoden im Detail und wann sich welche lohnt.
Gemini oder ChatGPT: was sich in der Praxis unterscheidet
| Aspekt | Gemini | ChatGPT |
|---|---|---|
| Prompt-Stil | Konversationeller Fließtext | Konversationeller Fließtext |
| Bearbeitung per Konversation | Stark, mit guter Bewahrung des Originals | Stark, mit guter Bewahrung des Originals |
| Mehrere Eingabebilder | Stärke, einschließlich Stilübertragung | Unterstützt |
| Text im Bild | Sehr gut, noch besser im Pro-Modell | Sehr gut |
| Modellwahl | Explizit: Schnell, Denken oder Pro | Sofort oder Denken, je nach Plan |
| Download-Auflösung | 1K kostenlos, 2K mit Plan | Bis zu 2K |
Die beiden Tools sind sich stark angenähert. Das praktische Kriterium ist, dieselbe Anfrage bei beiden zu testen und zu vergleichen — und das zu nutzen, das bei deinem Bildtyp besser abschneidet. Der ChatGPT-Guide zum Bilder erstellen deckt die andere Seite im Detail ab, und der Vergleich der besten KIs zum Bilder erstellen stellt die wichtigsten Optionen nebeneinander.
Was Gemini noch nicht gut kann
- Identifizierbare reale Personen. Die Erzeugung öffentlicher Figuren ist blockiert, und eine Umformulierung der Anfrage umgeht das nicht.
- Marken und lizenzierte Figuren. Logos bestehender Unternehmen und geschützte Figuren werden abgelehnt.
- Echte Vektoren. Die Ausgabe ist immer gerastert. Für eine editierbare Kurven-Datei dient das Ergebnis als Referenz zum Nachzeichnen.
- Zuverlässig transparenter Hintergrund. Selbst bei ausdrücklicher Bitte kommt meist ein solider Hintergrund. Die Transparenz lässt sich danach schneller lösen.
- Absolute Genauigkeit beim Bearbeiten eigener Fotos. Beim Ändern eines gesendeten Bildes erzeugt das Modell die Szene neu, feine Details ändern sich.
- Hohes Volumen ohne Plan. Das tägliche Kontingent in der kostenlosen Nutzung ist begrenzt.
Sieben Fehler, die am meisten stören
- Das Pro-Modell zum Testen nutzen. Verbraucht Kontingent, das für die finale Version fehlen würde.
- Im Tag-Format schreiben. Eine Wortliste ist die Sprache anderer Tools; hier bringt Fließtext mehr.
- Das Seitenverhältnis nicht nennen. Ohne Angabe ist das Format fast nie das, was du brauchst.
- Den Prompt bei jedem Versuch neu schreiben. Du verlierst, was bereits stimmte. Verlange gezielte Korrekturen.
- Eine Referenz mit unaufgeräumtem Hintergrund senden. Das Modell übernimmt Elemente der Szenerie, die du nicht verlangt hast.
- Per Screenshot speichern. Verliert Auflösung und fügt erneute Komprimierung hinzu.
- Ohne Optimierung veröffentlichen. 2K-Bilder sind schwer und verlangsamen jede Seite beim Laden.
Nach der Erzeugung: das Bild vorbereiten
Das Bild, das aus Gemini kommt, ist bereit zum Betrachten, nicht zum Veröffentlichen. Vier Schritte lösen das.
Format konvertieren. PNG ist großartig für Transparenz und schlecht für Fotos im Web. Für Websites reduziert WebP das Gewicht meist um die Hälfte ohne sichtbaren Unterschied; für normalen Versand reicht JPG. Der Bildkonverter erledigt den Wechsel im Browser, und der Guide zu Bildformaten hilft bei der Wahl.
Gewicht reduzieren. Ein 2K-Bild liegt leicht über mehreren Megabyte. Der Bildkompressor schneidet einen Großteil davon ohne sichtbaren Verlust ab.
Größe und Bildausschnitt anpassen. Für eine bestimmte Größe nutze den Größenänderer; stimmt das Seitenverhältnis nicht, bewahrt Zuschneiden mehr Qualität als Strecken.
Motiv bei Bedarf isolieren. Für Produkte, Logos und Elemente auf farbigem Hintergrund liefert den Hintergrund zu entfernen das transparente PNG, das die Erzeugung nicht liefert.
💡 Reihenfolge, die funktioniert: in voller Auflösung herunterladen → zuschneiden oder Größe ändern → Format konvertieren → zuletzt komprimieren. Vor dem Größenändern zu komprimieren verschwendet Qualität.
Checkliste vor der Erzeugung
- Entspricht das gewählte Modell der Komplexität der Anfrage?
- Ist das Seitenverhältnis angegeben?
- Steht der Prompt in Fließtext, mit Subjekt, Aktion und Szene?
- Steht ein eventueller Text in Anführungszeichen mit festgelegter Position?
- Haben die gesendeten Referenzen einen sauberen Hintergrund?
- Verlangst du eine Korrektur, statt alles neu zu schreiben?
- Lädst du in voller Auflösung herunter, statt per Screenshot?
Konvertiere deine Bilder ins richtige Format
Verwandle das schwere PNG von Gemini in WebP oder JPG und mach das Bild veröffentlichungsbereit, direkt im Browser.
Bild konvertieren