Jeśli szukałeś już informacji o generowaniu obrazów w Gemini, pewnie natknąłeś się na plątaninę nazw: Nano Banana, Nano Banana 2, Nano Banana Pro, Gemini 3.1 Flash Image. Wyglądają na osobne produkty, ale nimi nie są — Nano Banana to po prostu nazwa natywnego generowania obrazów w Gemini, a reszta to jego wersje.

To rozróżnienie ma znaczenie, bo wybór modelu wpływa na wynik bardziej niż cokolwiek innego. Infografika z gęstym tekstem zrobiona w szybkim modelu wychodzi z krzywymi literami; to samo polecenie w Pro daje czytelny efekt. Wiedza, czego użyć w danym przypadku, oszczędza prób i dziennego limitu.

Ten poradnik omawia trzy modele i sytuacje dla każdego z nich, przebieg generowania krok po kroku, pisanie promptów w formie, którą Gemini wykorzystuje najlepiej, edycję przez rozmowę — czyli największy atut narzędzia — oraz rzeczywiste ograniczenia.

Czym jest Nano Banana

Nano Banana to nazwa natywnej funkcji generowania i edycji obrazów w Gemini. Natywnej, czyli wbudowanej w samego Gemini, a nie uruchamianej jako osobny system — model rozumie polecenie w kontekście całej rozmowy, łącznie z wgranymi zdjęciami i tym, co padło wcześniej.

W lutym 2026 Nano Banana 2 stał się domyślną drogą generowania obrazów w głównych produktach Google, w tym w aplikacji Gemini. Nano Banana Pro pozostał opcją o wysokiej wierności, przeznaczoną głównie dla osób z planem płatnym.

Trzy modele i kiedy sięgać po każdy z nich

W Gemini menu modeli opisuje sposób działania — Szybki, Rozumowanie i Pro. Pod spodem kryją się trzy różne modele.

ModelCharakterystykaKiedy używać
Nano Banana 2 Lite (Szybki)Najszybszy i najtańszyTesty, szybkie warianty, proste grafiki z jedną sceną
Nano Banana 2 (Rozumowanie)Generalista, domyślny do niemal wszystkiegoWiększość zastosowań: sceny, portrety, produkty, ilustracje
Nano Banana ProWysoka wierność, gęsty tekst i złożony układInfografiki, plakaty z dużą ilością tekstu, materiały produkcyjne

Przydatna cecha tego przepływu: możesz najpierw wygenerować obraz w modelu domyślnym, a gdy efekt wymaga więcej detalu, powtórzyć go w Pro. W planach płatnych opcja kryje się w menu trzech kropek przy wygenerowanej grafice, jako „Powtórz w Pro”. Ograniczenie jest takie, że po wyczerpaniu dziennego limitu modelu domyślnego powtórzenie w Pro też przestaje być dostępne.

💡 Strategia na limit: szukaj działającej kompozycji w szybkim modelu i dopiero potem powtórz ją w Pro. Zużywanie droższego modelu na testy to błąd, który marnuje dzienny limit najszybciej.

Jak wygenerować pierwszy obraz

  1. Otwórz Gemini. Na komputerze przez przeglądarkę, na telefonie przez aplikację.
  2. Wejdź w sekcję obrazów. Na pasku bocznym znajdziesz sekcję Obrazy, a w menu narzędzi opcję tworzenia grafik.
  3. Wybierz model. Szybki, Rozumowanie albo Pro, zgodnie z tabelą powyżej. W razie wątpliwości zacznij od domyślnego.
  4. Napisz polecenie zwykłym językiem. Pełne zdania działają lepiej niż listy słów po przecinku.
  5. Poproś o poprawki w tej samej rozmowie. „Przyciemnij tło”, „zmień porę na późne popołudnie”, „usuń roślinę z rogu”. Model zachowa obraz i zmieni tylko to, o co poprosisz.
  6. Pobierz plik w pełnej rozdzielczości. Korzystaj z przycisku pobierania, nigdy ze zrzutu ekranu.

Rozdzielczość: co da się pobrać

Rozdzielczość pobierania zależy od planu. Bez płatnego planu Google z AI plik wychodzi w 1K. Z planem można pobrać 2K. Nano Banana Pro to droga do wyższej wierności, zwłaszcza przy materiałach z tekstem i układem, które muszą wytrzymać powiększenie.

W praktyce do zwykłych zastosowań cyfrowych — post, miniatura, grafika na blogu, prezentacja — to, co daje Gemini, w zupełności wystarcza. Do dużego druku albo monitora o wysokiej rozdzielczości trzeba powiększyć obraz po wygenerowaniu. Możesz zwiększyć rozdzielczość obrazu bez utraty jakości, a efekt bywa dobry przy czystych, mało zagęszczonych kompozycjach.

Jak pisać prompty do Gemini

Samo Google podpowiada prostą formułę na start: poproś o obraz, podając podmiot, czynność i scenę. To dobry punkt wyjścia — a kolejny krok polega właśnie na jego rozbudowie.

Zacznij od formuły, potem dodawaj szczegóły

Minimalne polecenie wyglądałoby tak:

Create an image of a cat napping in a sunbeam on a window sill.

Efekt już będzie. Ale każda kolejna warstwa zbliża go do tego, co masz w głowie:

Create an image of a black cat curled up napping in a sunbeam on a wooden window sill, a linen curtain beside it swaying gently, dust motes visible in the light, medium side shot, warm late-afternoon light, beige and amber tones, contemplative domestic photography.

Pisz zdaniami, nie tagami

To najważniejsza różnica względem narzędzi w rodzaju Midjourney. Gemini jest rozmowny i lepiej wykorzystuje pełne zdania niż listy terminów po przecinku. Pisz tak, jakbyś opisywał scenę drugiej osobie.

Podaj proporcje

Jeśli tego nie zrobisz, model wybierze sam. Napisz „format pionowy pod relacje”, „kwadrat na Instagram”, „poziomy panoramiczny” albo podaj proporcje wprost.

Umieść tekst w cudzysłowie

Gdy grafika ma zawierać słowa, zapisz je dosłownie w cudzysłowie i wskaż miejsce. Bez tego model może je sparafrazować albo umieścić tam, gdzie uzna za stosowne.

Poprawiaj, zamiast pisać od nowa

Gdy coś wyjdzie źle, poproś o konkretną poprawkę zamiast przepisywać całość. „Zostaw kompozycję i zmień tylko kolor płaszcza na zielony” zachowuje to, co już było dobre. Przepisanie całego promptu tworzy nowy obraz bez związku z poprzednim.

Edycja przez rozmowę: największy atut

To tutaj Gemini wygrywa. Wgrywasz obraz — swój albo przez niego wygenerowany — i opisujesz zmianę słowami, bez maski, warstwy i zaznaczenia.

Podmiana tła

Zostawiasz obiekt i zamieniasz to, co za nim. Przydatne przy portretach, produktach i materiałach marketingowych.

Keep the person exactly as she is and replace the background with a light exposed-concrete wall, with soft natural light coming from the left. Preserve the lighting on her face.

Zmiana pogody i pory dnia

Słoneczny dzień zamienia się w noc, dochodzi deszcz, jesień ustępuje zimie. Ta sama scena w innym nastroju.

Keep the composition and every element. Change it from a sunny day to a rainy night, with the wet street reflecting the lights and low fog.

Zmiana ujęcia kamery

Prosisz o tę samą scenę widzianą z innego punktu. Nie jest to idealne, bo model musi zmyślić to, czego nie było widać, ale przy przestronnych kadrach wypada dobrze.

Show the same scene from a lower angle, close to the ground, keeping the same objects, the same lighting and the same style.

Przeniesienie stylu z referencji

Jedna z najbardziej przydatnych i najmniej znanych możliwości: wgrywasz dwa obrazy i prosisz, żeby faktura, kolor albo styl jednego trafił na drugi. To najszybszy sposób na testowanie estetyk bez zaczynania od zera.

Apply the colour palette and texture of the second image to the first one, keeping the composition, the objects and the framing of the first image exactly the same.

Dodawanie i usuwanie elementów

Usunięcie zbędnego przedmiotu, dostawienie rośliny, dodanie osoby w tle. Działa dobrze przy wyraźnie odgraniczonych elementach; usuwanie z obszarów o złożonej fakturze potrafi zostawić ślady.

Remove the car parked on the right and complete the street naturally, leaving the rest of the image unchanged.

Praca z obrazami referencyjnymi

Wgrywanie obrazów razem z poleceniem to najmocniejsza strona Gemini — warto poznać trzy sposoby korzystania z tego.

Referencja podmiotu. Wgrywasz zdjęcie osoby, produktu albo postaci i prosisz, żeby pojawiło się w nowej scenie. Model stara się zachować tożsamość obiektu i wymienić całą resztę.

Referencja stylu. Wgrywasz obraz o estetyce, którą chcesz powtórzyć, i prosisz o przeniesienie palety, faktury albo języka wizualnego na inną grafikę lub na scenę opisaną słowami.

Referencja kompozycji. Wgrywasz szkic, nieudane zdjęcie albo brudnopis i prosisz o przekształcenie go w gotową grafikę z zachowaniem rozmieszczenia elementów.

Praktyczna uwaga: im czystsza referencja, tym lepszy wynik. Obrazy z zabałaganionym tłem sprawiają, że model przeciąga elementy scenerii, o które nie prosiłeś. Jeśli twoja referencja ma ten problem, warto Usuń tło przed wgraniem — efekt poprawia się wyraźnie.

Tekst i infografiki

Czytelny tekst na grafice to jeden z najbardziej widocznych postępów tej generacji modeli i właśnie tu Nano Banana Pro się broni. Plakat z tytułem i podtytułem, infografika z etykietami, diagram z notatek, okładka z nazwą marki — jeszcze niedawno wszystko to wychodziło krzywo, a dziś w większości prób wygląda czysto.

Trzy rzeczy mocno poprawiają efekt przy tekście:

Mimo to przy materiałach, w których typografia musi być firmowa, najpewniejsza pozostaje droga: wygenerować grafikę bez napisów i Dodaj tekstwe właściwym kroju.

Osiem gotowych poleceń na co dzień

Szablony pokrywające najczęstsze potrzeby. Podmień to, co w nawiasach kwadratowych, i zostaw resztę. Prompty zapisujemy po angielsku, bo modele graficzne rozumieją ten język najpewniej.

Grafika nagłówkowa do artykułu

Create a widescreen horizontal image about [topic], with a clean composition, one central element in focus and the left side left emptier to hold text. Soft natural lighting, a palette of [colour] and neutrals, no text anywhere in the image.

Kwadratowy post do social mediów

Create a square image of [subject] with a minimalist aesthetic, a flat [colour] background, a soft shadow and plenty of negative space around the object. Even diffused light, high contrast between object and background, no text.

Plakat z tytułem

Create a vertical promotional poster for [event]. Title "[exact text]" in large letters at the top and, smaller, below it: "[exact text]". Background in [colour] with one simple graphic element. Editorial style, sans-serif typography, plenty of empty space.

Podmiana tła na zdjęciu

Keep the person exactly as she is, without changing her face, hair or clothing. Replace only the background with [scene description], preserving the same direction of light falling on her.

Wariant stylistyczny

Keep the same composition, the same elements and the same framing, but redo the image in [watercolour / vector illustration / realistic photography] style, with a [description] palette.

Makieta produktu

Create a product photo of [product] on [surface], [colour] background in a soft gradient, studio lighting with a side softbox, slightly elevated frontal angle, controlled reflection, high sharpness, no text and no label.

Prosta infografika

Create a horizontal infographic with three equal columns explaining [topic]. Each column has a simple icon at the top, a short title and a supporting sentence. The titles are "[text]", "[text]" and "[text]". Palette of [two colours], clean editorial style, no shadows.

Oczyszczenie zdjęcia

Remove [unwanted element] from the image and fill the area naturally, keeping everything else unchanged, with the same lighting and the same level of detail.

Spójność postaci w Gemini

Skoro edycja odbywa się w rozmowie, najskuteczniejsza metoda jest zarazem najprostsza: zostań w tym samym wątku. Po wygenerowaniu postaci proś o kolejne sceny bez ponownego opisu — „a teraz pokaż tę samą postać siedzącą w kawiarni” — a nagromadzony kontekst zrobi swoje.

Przy dłuższej serii albo powrocie do tematu innego dnia użyj obrazu jako referencji podmiotu i trzymaj stały opis niezmiennych cech, powtarzany słowo w słowo. Poradnik o zachowaniu spójności postaci w AI omawia cztery metody i sytuacje, w których każda się opłaca.

Gemini czy ChatGPT: co zmienia się w praktyce

ElementGeminiChatGPT
Styl promptuRozmowne zdaniaRozmowne zdania
Edycja przez rozmowęMocna strona, z dobrym zachowaniem oryginałuMocna strona, z dobrym zachowaniem oryginału
Wiele obrazów wejściowychMocna strona, łącznie z przenoszeniem styluObsługiwane
Tekst na graficeBardzo dobry, a w modelu Pro jeszcze lepszyBardzo dobry
Wybór modeluJawny: Szybki, Rozumowanie albo ProNatychmiastowy albo z rozumowaniem, zależnie od planu
Rozdzielczość pobierania1K w darmowym, 2K z planemDo 2K

Oba narzędzia mocno się do siebie zbliżyły. Praktyczne kryterium jest jedno: wpisz to samo polecenie w obu, porównaj wyniki i zostań przy tym, który lepiej radzi sobie z twoim rodzajem grafiki. Poradnik o tworzeniu obrazów w ChatGPT opisuje drugą stronę szczegółowo, a zestawienie najlepszych AI do tworzenia obrazów stawia główne opcje obok siebie.

Czego Gemini nie robi dobrze

Siedem błędów, które szkodzą najbardziej

  1. Testowanie w modelu Pro. Zużywa limit, którego zabraknie na wersję finalną.
  2. Pisanie w formie tagów. Lista słów to język innych narzędzi; tutaj lepiej działają zdania.
  3. Pominięcie proporcji. Bez wskazówki format prawie nigdy nie będzie tym, którego potrzebujesz.
  4. Przepisywanie promptu przy każdej próbie. Tracisz to, co już wyszło dobrze. Proś o punktowe poprawki.
  5. Wgrywanie referencji z zabałaganionym tłem. Model przeciąga elementy scenerii, o które nie prosiłeś.
  6. Zapisywanie zrzutem ekranu. Traci rozdzielczość i dokłada kompresję.
  7. Publikowanie bez optymalizacji. Grafiki w 2K ważą sporo i potrafią położyć ładowanie każdej strony.

Po wygenerowaniu: przygotowanie pliku

Obraz wychodzący z Gemini jest gotowy do obejrzenia, a nie do publikacji. Załatwiają to cztery kroki.

Zmień format. PNG świetnie radzi sobie z przezroczystością i słabo ze zdjęciami w sieci. Na stronę WebP zwykle zbija wagę o połowę bez widocznej różnicy, a do zwykłej wysyłki wystarczy JPG. Narzędzie Konwertuj zrobi konwersję w przeglądarce, a przewodnik po formatach obrazów pomoże wybrać.

Zbij wagę pliku. Grafika 2K łatwo przekracza kilka megabajtów. Narzędzie Kompresuj zetnie sporą część bez widocznej straty.

Dopasuj rozmiar i kadr. Do konkretnych wymiarów użyj narzędzia Zmień rozmiar, a gdy proporcje wyszły inne, niż potrzeba, Kadrowanie obrazu zachowa więcej jakości niż rozciąganie.

W razie potrzeby wytnij obiekt. Przy produktach, logo i elementach lądujących na kolorowym tle narzędzie Usuń tło da ci przezroczysty PNG, którego samo generowanie nie zapewnia.

💡 Kolejność, która działa: pobierz w pełnej rozdzielczości → przytnij lub przeskaluj → zmień format → kompresuj na końcu. Kompresja przed skalowaniem marnuje jakość.

Lista kontrolna przed generowaniem

Zamień swoje grafiki na właściwy format

Zamień ciężki PNG z Gemini na WebP albo JPG i przygotuj grafikę do publikacji, prosto w przeglądarce.

Przekonwertuj obraz

Najczęstsze pytania

Czym jest Nano Banana i jak wiąże się z Gemini?
Nano Banana to nazwa natywnego generowania obrazów w Gemini — nie osobny produkt ani odrębna aplikacja. W rodzinie są dziś trzy modele: Lite, nastawiony na szybkość i koszt, Nano Banana 2, czyli domyślny generalista od lutego 2026, oraz Nano Banana Pro o wysokiej wierności, przeznaczony do gęstego tekstu i złożonych układów. W aplikacji widnieją w menu jako Szybki, Rozumowanie i Pro.
Czy da się tworzyć obrazy w Gemini za darmo?
Tak, z ograniczeniami. Darmowe korzystanie ma dzienny limit generowania, a plik pobierasz w rozdzielczości 1K. Z płatnym planem Google z AI pobieranie rośnie do 2K i pojawia się opcja ponownego wygenerowania obrazu w Nano Banana Pro. Praktyczny szczegół, który zaskakuje wiele osób: gdy skończy się dzienny limit modelu domyślnego, ponowne generowanie w Pro też przestaje działać, nawet z planem.
Który model wybrać do jakiego rodzaju obrazu?
W większości przypadków — sceny, portrety, produkty, ilustracje — domyślny model w zupełności wystarcza. Szybki służy do szukania kompozycji i generowania wariantów bez zużywania limitu droższego modelu. Pro opłaca się, gdy w grę wchodzi gęsty tekst, infografika, diagram, plakat z hierarchią typograficzną albo materiał idący do produkcji. Najbardziej oszczędna strategia to testować w szybkim i przepuścić przez Pro tylko wybraną wersję.
Jak edytować własne zdjęcie w Gemini?
Wgraj zdjęcie w rozmowie i opisz zmianę zwykłym językiem — podmiana tła, inne światło, usunięcie przedmiotu, inny styl. Maska ani zaznaczenie nie są potrzebne. Warto wiedzieć, że wynik to nowy obraz stworzony na podstawie twojego, a nie edycja piksel po pikselu: kompozycja zostaje, ale drobne detale oryginału się zmieniają. Przy zmianach wymagających pełnej wierności lepszy pozostaje klasyczny edytor.
Jak uzyskać przezroczyste tło?
Nawet przy wyraźnej prośbie obraz zwykle ma jednolite tło zamiast prawdziwej przezroczystości. Najszybciej poprosić o gładkie białe tło, które najłatwiej wyciąć, i zrobić przezroczystość później, usuwając tło i zapisując plik w PNG. Upieranie się przy modelu zwykle kończy się narysowaną szachownicą udającą przezroczystość, z której nie ma żadnego pożytku.
Czy mogę wykorzystywać wygenerowane obrazy komercyjnie?
Zasady zależą od planu, kraju i aktualnego regulaminu Google, a te bywają zmieniane. Poza tym zgoda na użytek komercyjny to nie to samo co ochrona prawna: w wielu jurysdykcjach dzieła powstałe w całości maszynowo napotykają ograniczenia w zakresie praw autorskich. Zanim użyjesz grafiki w materiale dla klienta albo w produkcie na sprzedaż, sprawdź obowiązujące warunki i unikaj poleceń dotyczących znaków towarowych, licencjonowanych postaci i prawdziwych osób.