Jeśli szukałeś już informacji o generowaniu obrazów w Gemini, pewnie natknąłeś się na plątaninę nazw: Nano Banana, Nano Banana 2, Nano Banana Pro, Gemini 3.1 Flash Image. Wyglądają na osobne produkty, ale nimi nie są — Nano Banana to po prostu nazwa natywnego generowania obrazów w Gemini, a reszta to jego wersje.
To rozróżnienie ma znaczenie, bo wybór modelu wpływa na wynik bardziej niż cokolwiek innego. Infografika z gęstym tekstem zrobiona w szybkim modelu wychodzi z krzywymi literami; to samo polecenie w Pro daje czytelny efekt. Wiedza, czego użyć w danym przypadku, oszczędza prób i dziennego limitu.
Ten poradnik omawia trzy modele i sytuacje dla każdego z nich, przebieg generowania krok po kroku, pisanie promptów w formie, którą Gemini wykorzystuje najlepiej, edycję przez rozmowę — czyli największy atut narzędzia — oraz rzeczywiste ograniczenia.
Czym jest Nano Banana
Nano Banana to nazwa natywnej funkcji generowania i edycji obrazów w Gemini. Natywnej, czyli wbudowanej w samego Gemini, a nie uruchamianej jako osobny system — model rozumie polecenie w kontekście całej rozmowy, łącznie z wgranymi zdjęciami i tym, co padło wcześniej.
W lutym 2026 Nano Banana 2 stał się domyślną drogą generowania obrazów w głównych produktach Google, w tym w aplikacji Gemini. Nano Banana Pro pozostał opcją o wysokiej wierności, przeznaczoną głównie dla osób z planem płatnym.
Trzy modele i kiedy sięgać po każdy z nich
W Gemini menu modeli opisuje sposób działania — Szybki, Rozumowanie i Pro. Pod spodem kryją się trzy różne modele.
| Model | Charakterystyka | Kiedy używać |
|---|---|---|
| Nano Banana 2 Lite (Szybki) | Najszybszy i najtańszy | Testy, szybkie warianty, proste grafiki z jedną sceną |
| Nano Banana 2 (Rozumowanie) | Generalista, domyślny do niemal wszystkiego | Większość zastosowań: sceny, portrety, produkty, ilustracje |
| Nano Banana Pro | Wysoka wierność, gęsty tekst i złożony układ | Infografiki, plakaty z dużą ilością tekstu, materiały produkcyjne |
Przydatna cecha tego przepływu: możesz najpierw wygenerować obraz w modelu domyślnym, a gdy efekt wymaga więcej detalu, powtórzyć go w Pro. W planach płatnych opcja kryje się w menu trzech kropek przy wygenerowanej grafice, jako „Powtórz w Pro”. Ograniczenie jest takie, że po wyczerpaniu dziennego limitu modelu domyślnego powtórzenie w Pro też przestaje być dostępne.
💡 Strategia na limit: szukaj działającej kompozycji w szybkim modelu i dopiero potem powtórz ją w Pro. Zużywanie droższego modelu na testy to błąd, który marnuje dzienny limit najszybciej.
Jak wygenerować pierwszy obraz
- Otwórz Gemini. Na komputerze przez przeglądarkę, na telefonie przez aplikację.
- Wejdź w sekcję obrazów. Na pasku bocznym znajdziesz sekcję Obrazy, a w menu narzędzi opcję tworzenia grafik.
- Wybierz model. Szybki, Rozumowanie albo Pro, zgodnie z tabelą powyżej. W razie wątpliwości zacznij od domyślnego.
- Napisz polecenie zwykłym językiem. Pełne zdania działają lepiej niż listy słów po przecinku.
- Poproś o poprawki w tej samej rozmowie. „Przyciemnij tło”, „zmień porę na późne popołudnie”, „usuń roślinę z rogu”. Model zachowa obraz i zmieni tylko to, o co poprosisz.
- Pobierz plik w pełnej rozdzielczości. Korzystaj z przycisku pobierania, nigdy ze zrzutu ekranu.
Rozdzielczość: co da się pobrać
Rozdzielczość pobierania zależy od planu. Bez płatnego planu Google z AI plik wychodzi w 1K. Z planem można pobrać 2K. Nano Banana Pro to droga do wyższej wierności, zwłaszcza przy materiałach z tekstem i układem, które muszą wytrzymać powiększenie.
W praktyce do zwykłych zastosowań cyfrowych — post, miniatura, grafika na blogu, prezentacja — to, co daje Gemini, w zupełności wystarcza. Do dużego druku albo monitora o wysokiej rozdzielczości trzeba powiększyć obraz po wygenerowaniu. Możesz zwiększyć rozdzielczość obrazu bez utraty jakości, a efekt bywa dobry przy czystych, mało zagęszczonych kompozycjach.
Jak pisać prompty do Gemini
Samo Google podpowiada prostą formułę na start: poproś o obraz, podając podmiot, czynność i scenę. To dobry punkt wyjścia — a kolejny krok polega właśnie na jego rozbudowie.
Zacznij od formuły, potem dodawaj szczegóły
Minimalne polecenie wyglądałoby tak:
Efekt już będzie. Ale każda kolejna warstwa zbliża go do tego, co masz w głowie:
Pisz zdaniami, nie tagami
To najważniejsza różnica względem narzędzi w rodzaju Midjourney. Gemini jest rozmowny i lepiej wykorzystuje pełne zdania niż listy terminów po przecinku. Pisz tak, jakbyś opisywał scenę drugiej osobie.
Podaj proporcje
Jeśli tego nie zrobisz, model wybierze sam. Napisz „format pionowy pod relacje”, „kwadrat na Instagram”, „poziomy panoramiczny” albo podaj proporcje wprost.
Umieść tekst w cudzysłowie
Gdy grafika ma zawierać słowa, zapisz je dosłownie w cudzysłowie i wskaż miejsce. Bez tego model może je sparafrazować albo umieścić tam, gdzie uzna za stosowne.
Poprawiaj, zamiast pisać od nowa
Gdy coś wyjdzie źle, poproś o konkretną poprawkę zamiast przepisywać całość. „Zostaw kompozycję i zmień tylko kolor płaszcza na zielony” zachowuje to, co już było dobre. Przepisanie całego promptu tworzy nowy obraz bez związku z poprzednim.
Edycja przez rozmowę: największy atut
To tutaj Gemini wygrywa. Wgrywasz obraz — swój albo przez niego wygenerowany — i opisujesz zmianę słowami, bez maski, warstwy i zaznaczenia.
Podmiana tła
Zostawiasz obiekt i zamieniasz to, co za nim. Przydatne przy portretach, produktach i materiałach marketingowych.
Zmiana pogody i pory dnia
Słoneczny dzień zamienia się w noc, dochodzi deszcz, jesień ustępuje zimie. Ta sama scena w innym nastroju.
Zmiana ujęcia kamery
Prosisz o tę samą scenę widzianą z innego punktu. Nie jest to idealne, bo model musi zmyślić to, czego nie było widać, ale przy przestronnych kadrach wypada dobrze.
Przeniesienie stylu z referencji
Jedna z najbardziej przydatnych i najmniej znanych możliwości: wgrywasz dwa obrazy i prosisz, żeby faktura, kolor albo styl jednego trafił na drugi. To najszybszy sposób na testowanie estetyk bez zaczynania od zera.
Dodawanie i usuwanie elementów
Usunięcie zbędnego przedmiotu, dostawienie rośliny, dodanie osoby w tle. Działa dobrze przy wyraźnie odgraniczonych elementach; usuwanie z obszarów o złożonej fakturze potrafi zostawić ślady.
Praca z obrazami referencyjnymi
Wgrywanie obrazów razem z poleceniem to najmocniejsza strona Gemini — warto poznać trzy sposoby korzystania z tego.
Referencja podmiotu. Wgrywasz zdjęcie osoby, produktu albo postaci i prosisz, żeby pojawiło się w nowej scenie. Model stara się zachować tożsamość obiektu i wymienić całą resztę.
Referencja stylu. Wgrywasz obraz o estetyce, którą chcesz powtórzyć, i prosisz o przeniesienie palety, faktury albo języka wizualnego na inną grafikę lub na scenę opisaną słowami.
Referencja kompozycji. Wgrywasz szkic, nieudane zdjęcie albo brudnopis i prosisz o przekształcenie go w gotową grafikę z zachowaniem rozmieszczenia elementów.
Praktyczna uwaga: im czystsza referencja, tym lepszy wynik. Obrazy z zabałaganionym tłem sprawiają, że model przeciąga elementy scenerii, o które nie prosiłeś. Jeśli twoja referencja ma ten problem, warto Usuń tło przed wgraniem — efekt poprawia się wyraźnie.
Tekst i infografiki
Czytelny tekst na grafice to jeden z najbardziej widocznych postępów tej generacji modeli i właśnie tu Nano Banana Pro się broni. Plakat z tytułem i podtytułem, infografika z etykietami, diagram z notatek, okładka z nazwą marki — jeszcze niedawno wszystko to wychodziło krzywo, a dziś w większości prób wygląda czysto.
Trzy rzeczy mocno poprawiają efekt przy tekście:
- Zapisz dokładny tekst w cudzysłowie. Bez tego model potraktuje słowo jak temat i może je sparafrazować.
- Opisz hierarchię. „Duży tytuł u góry, mniejszy podtytuł poniżej, trzy krótkie bloki tekstu na dole” daje znacznie większą kontrolę niż zostawienie tego otwartym.
- Użyj modelu Pro. Gęsty układ i mały tekst to dokładnie ten przypadek, w którym różnica między modelami staje się widoczna.
Mimo to przy materiałach, w których typografia musi być firmowa, najpewniejsza pozostaje droga: wygenerować grafikę bez napisów i Dodaj tekstwe właściwym kroju.
Osiem gotowych poleceń na co dzień
Szablony pokrywające najczęstsze potrzeby. Podmień to, co w nawiasach kwadratowych, i zostaw resztę. Prompty zapisujemy po angielsku, bo modele graficzne rozumieją ten język najpewniej.
Grafika nagłówkowa do artykułu
Kwadratowy post do social mediów
Plakat z tytułem
Podmiana tła na zdjęciu
Wariant stylistyczny
Makieta produktu
Prosta infografika
Oczyszczenie zdjęcia
Spójność postaci w Gemini
Skoro edycja odbywa się w rozmowie, najskuteczniejsza metoda jest zarazem najprostsza: zostań w tym samym wątku. Po wygenerowaniu postaci proś o kolejne sceny bez ponownego opisu — „a teraz pokaż tę samą postać siedzącą w kawiarni” — a nagromadzony kontekst zrobi swoje.
Przy dłuższej serii albo powrocie do tematu innego dnia użyj obrazu jako referencji podmiotu i trzymaj stały opis niezmiennych cech, powtarzany słowo w słowo. Poradnik o zachowaniu spójności postaci w AI omawia cztery metody i sytuacje, w których każda się opłaca.
Gemini czy ChatGPT: co zmienia się w praktyce
| Element | Gemini | ChatGPT |
|---|---|---|
| Styl promptu | Rozmowne zdania | Rozmowne zdania |
| Edycja przez rozmowę | Mocna strona, z dobrym zachowaniem oryginału | Mocna strona, z dobrym zachowaniem oryginału |
| Wiele obrazów wejściowych | Mocna strona, łącznie z przenoszeniem stylu | Obsługiwane |
| Tekst na grafice | Bardzo dobry, a w modelu Pro jeszcze lepszy | Bardzo dobry |
| Wybór modelu | Jawny: Szybki, Rozumowanie albo Pro | Natychmiastowy albo z rozumowaniem, zależnie od planu |
| Rozdzielczość pobierania | 1K w darmowym, 2K z planem | Do 2K |
Oba narzędzia mocno się do siebie zbliżyły. Praktyczne kryterium jest jedno: wpisz to samo polecenie w obu, porównaj wyniki i zostań przy tym, który lepiej radzi sobie z twoim rodzajem grafiki. Poradnik o tworzeniu obrazów w ChatGPT opisuje drugą stronę szczegółowo, a zestawienie najlepszych AI do tworzenia obrazów stawia główne opcje obok siebie.
Czego Gemini nie robi dobrze
- Rozpoznawalne prawdziwe osoby. Tworzenie wizerunków osób publicznych jest zablokowane, a przeformułowanie polecenia tego nie obejdzie.
- Marki i licencjonowane postacie. Logotypy istniejących firm i chronione postacie są odrzucane.
- Prawdziwy wektor. Wynik zawsze jest rastrowy. Gdy potrzebujesz pliku edytowalnego na krzywych, grafika posłuży jako wzór do przerysowania.
- Pewna przezroczystość tła. Nawet po prośbie tło zwykle jest jednolite. Przezroczystość szybciej załatwić później.
- Pełna wierność przy edycji twojego zdjęcia. Przy zmianie wgranego pliku model tworzy scenę na nowo i drobne detale się zmieniają.
- Duży wolumen bez planu. Dzienny limit w wersji darmowej jest niewielki.
Siedem błędów, które szkodzą najbardziej
- Testowanie w modelu Pro. Zużywa limit, którego zabraknie na wersję finalną.
- Pisanie w formie tagów. Lista słów to język innych narzędzi; tutaj lepiej działają zdania.
- Pominięcie proporcji. Bez wskazówki format prawie nigdy nie będzie tym, którego potrzebujesz.
- Przepisywanie promptu przy każdej próbie. Tracisz to, co już wyszło dobrze. Proś o punktowe poprawki.
- Wgrywanie referencji z zabałaganionym tłem. Model przeciąga elementy scenerii, o które nie prosiłeś.
- Zapisywanie zrzutem ekranu. Traci rozdzielczość i dokłada kompresję.
- Publikowanie bez optymalizacji. Grafiki w 2K ważą sporo i potrafią położyć ładowanie każdej strony.
Po wygenerowaniu: przygotowanie pliku
Obraz wychodzący z Gemini jest gotowy do obejrzenia, a nie do publikacji. Załatwiają to cztery kroki.
Zmień format. PNG świetnie radzi sobie z przezroczystością i słabo ze zdjęciami w sieci. Na stronę WebP zwykle zbija wagę o połowę bez widocznej różnicy, a do zwykłej wysyłki wystarczy JPG. Narzędzie Konwertuj zrobi konwersję w przeglądarce, a przewodnik po formatach obrazów pomoże wybrać.
Zbij wagę pliku. Grafika 2K łatwo przekracza kilka megabajtów. Narzędzie Kompresuj zetnie sporą część bez widocznej straty.
Dopasuj rozmiar i kadr. Do konkretnych wymiarów użyj narzędzia Zmień rozmiar, a gdy proporcje wyszły inne, niż potrzeba, Kadrowanie obrazu zachowa więcej jakości niż rozciąganie.
W razie potrzeby wytnij obiekt. Przy produktach, logo i elementach lądujących na kolorowym tle narzędzie Usuń tło da ci przezroczysty PNG, którego samo generowanie nie zapewnia.
💡 Kolejność, która działa: pobierz w pełnej rozdzielczości → przytnij lub przeskaluj → zmień format → kompresuj na końcu. Kompresja przed skalowaniem marnuje jakość.
Lista kontrolna przed generowaniem
- Czy wybrany model odpowiada złożoności polecenia?
- Czy proporcje są podane?
- Czy prompt jest napisany zdaniami, z podmiotem, czynnością i sceną?
- Jeśli ma być tekst, czy jest w cudzysłowie i ma wskazane miejsce?
- Czy wgrane referencje mają czyste tło?
- Czy prosisz o poprawkę zamiast przepisywać całość?
- Czy pobierzesz plik w pełnej rozdzielczości, a nie zrzutem ekranu?
Zamień swoje grafiki na właściwy format
Zamień ciężki PNG z Gemini na WebP albo JPG i przygotuj grafikę do publikacji, prosto w przeglądarce.
Przekonwertuj obraz