Obrazy z AI potrafią zmylić nawet wprawne oko. Midjourney, DALL-E 3, Stable Diffusion i Flux zrobiły w ostatnich dwóch latach taki postęp, że stary żart o liczeniu palców przestał wystarczać. Wciąż jednak istnieją powtarzalne tropy — techniczne i wizualne — które zdradzają sztuczne pochodzenie obrazu, także w najnowszych modelach. W tym poradniku nauczysz się analizować obraz warstwa po warstwie: od kompozycji, przez metadane ukryte w pliku, aż po najbardziej wiarygodne dziś narzędzia detekcyjne.

Dlaczego rozpoznawanie obrazów z AI stało się ważne

Jeszcze niedawno rozpoznanie obrazu z AI było ciekawostką techniczną. Dziś to praktyczna umiejętność, która wpływa na codzienne decyzje. Kupujący na platformach sprzedażowych chcą wiedzieć, czy „zdjęcie produktu” faktycznie pochodzi od sprzedawcy, czy jest generyczną grafiką z AI. Rekruterzy przyglądają się zdjęciom z LinkedIna i CV. Dziennikarze i fact-checkerzy weryfikują obrazy krążące w sieci, zanim je opublikują. Niestety, twarze z AI służą też do budowania przekonujących fałszywych profili w oszustwach matrymonialnych i kradzieżach tożsamości.

Skala problemu rosła razem z jakością modeli. W 2023 roku większość obrazów z AI miała oczywiste błędy w dłoniach i tekście. W 2026 modele takie jak Midjourney v7, Flux 1.1 Pro czy Gemini Image w większości przypadków trzymają poprawną anatomię, więc pobieżne oględziny coraz mniej dają. Bezpieczniej jest łączyć kilka tropów — wizualnych, technicznych i z narzędzi zewnętrznych — zamiast opierać się na jednej poszlace.

Warto to podkreślić: żadna z opisanych tu metod nie daje stuprocentowej pewności. Chodzi o zwiększenie trafności twojej oceny, a nie o zastąpienie krytycznego myślenia. Im więcej sygnałów wskazuje w tę samą stronę, tym pewniejszy wniosek.

Wizualne tropy, które wciąż zdradzają obraz z AI

Modele generatywne przewidują prawdopodobne piksele na podstawie wzorców statystycznych wyuczonych z milionów prawdziwych zdjęć. Dzięki temu świetnie radzą sobie z wiarygodną fakturą, ale wciąż potykają się tam, gdzie potrzebna jest sztywna spójność strukturalna — czyli przy rzeczach, które ludzki mózg liczy i sprawdza od dziecka, jak liczba palców czy symetria twarzy.

Dłonie, palce i stawy

To wciąż najczęściej wskazywana słabość, choć modele mocno się poprawiły. Sprawdź, czy palców nie jest za dużo albo za mało, czy stawy nie zginają się pod anatomicznie niemożliwym kątem i czy palce nie zlewają się ze sobą jak plastelina. Osobnym sygnałem są dłonie schowane za przedmiotem, w kieszeni albo pod włosami: generatory chętnie „chowają” to, co wychodzi im najgorzej.

Zęby, oczy i uszy

Zęby z AI bywają zbyt równym, jednolitym rzędem, bez drobnych nieregularności prawdziwego uzębienia. W oczach zdarzają się niespójne refleksy świetlne (catchlights) — blik w innym miejscu lub o innym kształcie w każdym oku, co przy jednym źródle światła fizycznie nie miałoby prawa się zdarzyć. Ucho z kolei ma złożoną budowę wewnętrzną (obrąbek, grobelka, skrawek), którą AI często upraszcza albo lekko zniekształca, zwłaszcza w ujęciach na trzy czwarte.

Włosy, tkaniny i powtarzalne wzory

Pojedyncze włosy zlewające się w jednolite bryły, wzór tkaniny (krata, paski) gubiący rytm w połowie ubrania albo kolczyki i naszyjniki różniące się między lewą a prawą stroną twarzy to powracające sygnały. AI rozumie „ideę” powtarzalnego wzoru, ale nie zawsze utrzymuje jego matematykę na całej powierzchni obrazu.

Tekst i typografia wewnątrz obrazu

Szyldy, napisy na koszulkach, etykiety produktów i tablice w tle to jeden z najsłabszych punktów. Nawet zaawansowane modele generują litery, które na pierwszy rzut oka wyglądają poprawnie, a z bliska okazują się znakami bez znaczenia — „prawie alfabetem”, który nie układa się w żadne prawdziwe słowa. To dziś jeden z najpewniejszych tropów.

Fizyka światła, cienia i odbicia

Cienie padające w inną stronę, niż sugerowałoby główne źródło światła, odbicia w szkle albo lustrze niepasujące do tego, co powinno się w nich znaleźć, oraz oświetlenie skóry rozmijające się ze światłem otoczenia to subtelne, ale powtarzalne poszlaki. Szczególnie uważnie oglądaj sceny z kilkoma źródłami światła (na przykład okno i lampa), bo tam AI najczęściej „miesza” cienie w sposób fizycznie niemożliwy.

Tło i kompozycja sceny

Zwróć uwagę na elementy tła zlewające się ze sobą bez wyraźnej granicy, przedmioty urwane bez powodu przy krawędzi kadru oraz dziwne powtórzenia — jak dwa niemal identyczne krzesła ustawione tak, jak w prawdziwym wnętrzu nikt by ich nie postawił. Rozmyte tło (bokeh) potrafi te niespójności zamaskować, więc właśnie rozmytym obszarom warto przyjrzeć się uważniej.

💡 Wskazówka: powiększ obraz co najmniej dwukrotnie i przyjrzyj się rogom oraz krawędziom — to tam modele najczęściej gubią drobne detale, bo ich „uwaga” skupia się na środku kompozycji.

Faktura skóry i problem nadmiernej perfekcji

Prawdziwe zdjęcia noszą drobne niedoskonałości: widoczne pory, delikatny meszek na twarzy, lekkie asymetrie, różnice tonu wynikające z naczyń krwionośnych tuż pod skórą. Obrazy z AI — zwłaszcza portrety „studyjne” — to wszystko wygładzają, tworząc niemal woskową powierzchnię, jak równo nałożony podkład o mocnym kryciu. Efekt jest najbardziej widoczny na jasnej cerze w bezpośrednim świetle, gdzie brak naturalnych różnic rzuca się w oczy.

Trzeba jednak pamiętać, że ten sam efekt daje mocne wygładzanie skóry filtrami (standard w aplikacjach aparatu w telefonie), więc lepiej traktować go jako wzmocnienie innych tropów niż jako samodzielny dowód.

Metadane EXIF: co zdradzają ukryte dane pliku

Każde zdjęcie z aparatu cyfrowego albo smartfona ma wbudowaną w plik warstwę danych technicznych zwaną EXIF (Exchangeable Image File Format). Znajdziesz tam model aparatu lub telefonu, rodzaj obiektywu, przysłonę, czas naświetlania, ISO, dokładną datę i godzinę wykonania zdjęcia, a często też współrzędne GPS.

Obrazy z AI wyeksportowane wprost z narzędzia zwykle nie mają tych pól wypełnionych albo zawierają ogólne informacje o programie generującym zamiast danych prawdziwego aparatu. Sprawdzisz to szybko narzędziem Usuń EXIF, które wyświetla wszystkie metadane pliku, zanim zdecydujesz, czy je usunąć, czy zostawić.

Content Credentials i inicjatywa C2PA

Ważnym i coraz istotniejszym krokiem naprzód jest standard C2PA (Coalition for Content Provenance and Authenticity), wdrażany m.in. przez Adobe, OpenAI, Google, Microsoft i Leicę. Obrazy powstałe w zgodnych narzędziach dostają znacznik „Content Credentials” — kryptograficzny zapis pochodzenia pliku, zawierający także informację, czy treść wygenerowała lub edytowała AI. Nie każdy obraz go jeszcze ma, ale jeśli jest, to jedna z najpewniejszych dostępnych dziś poszlak.

💡 Wskazówka: sam brak metadanych niczego nie dowodzi — serwisy społecznościowe, WhatsApp i większość aplikacji do edycji też je usuwają, przetwarzając i ponownie kompresując zdjęcie przed zapisem lub wysyłką. Traktuj to jako jeden z sygnałów, nigdy jako samodzielny dowód.

Automatyczne detektory: co jest dziś dostępne

Poza analizą własnym okiem istnieją wyspecjalizowane serwisy, które używają własnych modeli AI do wykrywania statystycznych wzorców pikseli niewidocznych dla człowieka — subtelnych podpisów zostawianych przez modele generatywne. Żaden nie jest nieomylny, ale świetnie sprawdzają się jako druga opinia, zwłaszcza w połączeniu z opisaną wyżej analizą wizualną.

NarzędzieJak działaNajlepsze zastosowanie
Hive ModerationKlasyfikator trenowany na milionach oznaczonych obrazówSzybkie sprawdzenie przez wgranie pliku lub API
IlluminartyAnaliza statystyczna wzorców pikseli i kompresjiZdjęcia i grafika cyfrowa
AI or NotPołączenie kilku klasyfikatorówSprawdzanie wielu obrazów naraz
Google SynthIDNiewidoczny znak wodny wtapiany przy generowaniu (gdy dotyczy)Obrazy tworzone w produktach Google
Optic (od AI or Not)Detekcja nastawiona na twarze i portretySprawdzanie profili i awatarów

Ważna uwaga: te narzędzia analizują wzorce statystyczne, które modele generatywne z każdą wersją starają się zacierać. Skuteczność detekcji zmienia się więc w czasie — narzędzie wykrywające 95% obrazów ze Stable Diffusion 1.5 może wypaść znacznie gorzej przy najnowszym Fluxie. Dlatego zawsze warto uruchomić więcej niż jeden detektor, zanim wyciągniesz wnioski.

Wyszukiwanie wsteczne jako uzupełnienie

Wyszukiwanie wsteczne w Google Lens albo TinEye potrafi dać cenny kontekst: pokaże, czy ten sam obraz pojawił się już gdzie indziej z innym podpisem, czy ktoś wcześniej uznał go za syntetyczny, a czasem nawet wskaże prawdziwe zdjęcie, które posłużyło za bazę do edycji przez AI (w oszustwach częsty jest schemat: wziąć czyjeś prawdziwe zdjęcie i „ulepszyć” je generatywnie).

Ta metoda szczególnie przydaje się przy podejrzanych zdjęciach profilowych w aplikacjach randkowych i serwisach społecznościowych, bo wiele fałszywych kont wykorzystuje — z edycją AI albo bez niej — zdjęcia prawdziwych osób bez ich zgody.

Jak potykają się poszczególne generatory

Każdy model ma własne „podpisy błędów”, wynikające ze zbioru treningowego i decyzji architektonicznych. Znajomość tych różnic pomaga dopasować analizę do prawdopodobnego pochodzenia obrazu.

GeneratorNajczęstszy błądMocna strona
MidjourneyZbyt idealne kompozycje, woskowa skóra w portretachBardzo przekonująca estetyka i światło
DALL-E 3Tekst prawie czytelny, ale błędny, lekko przesycone barwyDobre rozumienie złożonych promptów
Stable Diffusion (starsze wersje)Zniekształcone dłonie, asymetryczne oczyElastyczność i dostosowanie przez LoRA
FluxTła z subtelnie powtarzalnymi wzoramiZnacznie spójniejsza anatomia i dłonie
Gemini Image / ImagenOdbicia i cienie bywają niespójne w złożonych scenachFotorealizm w prostych scenach

Ta tabela nie jest sztywną regułą — modele aktualizują się często i charakterystyczne dziś błędy mogą zniknąć w kolejnej wersji. Mimo to podpowiada, gdzie zajrzeć najpierw, gdy podejrzewasz konkretny obraz.

Praktyczne sytuacje, w których to naprawdę się liczy

Zakupy na platformach sprzedażowych: zanim uwierzysz podejrzanie idealnemu zdjęciu produktu w ogłoszeniu z drugiej ręki, sprawdź metadane, spójność tła i to, czy drobiazgi (metki, szwy, faktury) mają fizyczny sens.

Weryfikacja dziennikarska: fact-checkerzy łączą wyszukiwanie wsteczne, analizę metadanych i detektory, zanim potwierdzą autentyczność obrazu krążącego wiralowo w czasie kryzysu albo ważnych wydarzeń.

Profile w social mediach i aplikacjach randkowych: zdjęcie profilowe w podejrzanie idealnym studyjnym świetle, brak jakiejkolwiek historii postów i unikanie rozmowy wideo to sygnały, które w połączeniu z tropami AI powinny wzmóc czujność.

Rekrutacja i HR: część firm już sprawdza, czy zdjęcie z CV albo LinkedIna nie powstało sztucznie, w ramach ostrzejszej weryfikacji tożsamości.

Typowe błędy przy wykrywaniu obrazów z AI

Częsty błąd to traktowanie jednego sygnału jak rozstrzygającego dowodu — na przykład odrzucenie prawdziwego zdjęcia tylko dlatego, że nie ma EXIF (a mogło go stracić, przechodząc przez WhatsAppa). Drugi to ślepa wiara w wynik jednego detektora, mimo że one także się mylą: dają fałszywe alarmy (prawdziwe zdjęcie uznane za AI) i przeoczenia (niewykryty świeży obraz syntetyczny).

Łatwo też przecenić własne oko: badania pokazują, że bez wsparcia narzędzi większość osób trafia z rozpoznaniem obrazów z AI mniej więcej na poziomie przypadku, gdy model jest nowy i dobrej jakości. Dlatego łączenie metod zawsze wypada pewniej niż poleganie na „wprawnym oku”.

Jest jeszcze trzeci częsty błąd: pomijanie kontekstu, w jakim obraz krąży. Zdjęcie bez możliwego do ustalenia źródła, bez wcześniejszej historii publikacji i opatrzone mocno emocjonalnym podpisem (na przykład wezwaniem do pilnego udostępnienia) zasługuje na większą nieufność niż obraz opublikowany przez zweryfikowane konto o spójnej historii — niezależnie od tropów technicznych w samym pliku. Pochodzenie i sposób rozprzestrzeniania są w praktyce równie ważne jak analiza piksel po pikselu.

Na koniec warto pamiętać, że obrazy bywają częściowo generowane przez AI — prawdziwe zdjęcie z podmienionym tłem, usuniętym przedmiotem albo cyfrowo zmienionym ubraniem. W takich przypadkach mieszanych tropy AI skupiają się w jednym miejscu kadru (zwykle tam, gdzie nastąpiła zmiana), zamiast rozkładać się równomiernie po całej scenie, jak przy obrazach w pełni syntetycznych.

Szybka lista kontrolna dla podejrzanego obrazu

  1. Powiększ obraz i sprawdź dłonie, zęby, uszy i biżuterię pod kątem asymetrii lub zniekształceń.
  2. Przyjrzyj się tekstowi i literom w kadrze — szyldom, etykietom, tablicom.
  3. Sprawdź, czy światło i cienie zgadzają się z widocznymi źródłami oświetlenia.
  4. Zajrzyj w metadane EXIF pliku narzędziem Usuń EXIF w ImageTools.
  5. Przepuść obraz przez co najmniej jeden automatyczny detektor (Hive, Illuminarty albo AI or Not).
  6. Zrób wyszukiwanie wsteczne, żeby poznać kontekst i pochodzenie obrazu.

Żaden punkt z tej listy nie musi rozstrzygać sam z siebie — wartość bierze się z sumowania poszlak. Obraz, który przechodzi czysto przez cztery czy pięć z nich, jest znacznie bardziej prawdopodobnie autentyczny niż taki, który budzi wątpliwości w kilku miejscach naraz.

Sprawdź metadane dowolnego obrazu

Użyj narzędzia Usuń EXIF w ImageTools, aby zajrzeć w ukryte dane pliku, zanim go udostępnisz albo mu zaufasz.

Sprawdź metadane teraz

Najczęstsze pytania

Czy istnieje w pełni pewny sposób na wykrycie obrazu z AI?
Nie. Nawet najlepsze detektory się mylą, a modele generatywne z każdą wersją zacierają widoczne ślady AI. Najlepiej łączyć kilka tropów — analizę wizualną, metadane, wyszukiwanie wsteczne i narzędzie detekcyjne — zanim wyciągniesz ostateczny wniosek. Im więcej sygnałów wskazuje w tę samą stronę, tym pewniejsza ocena.
Czy zdjęcia obrobione filtrami też tracą metadane EXIF?
Tak. Aplikacje do edycji, WhatsApp, Instagram i większość serwisów społecznościowych usuwają albo podmieniają oryginalne metadane, gdy przetwarzają i ponownie kompresują zdjęcie. Sam brak EXIF nie dowodzi więc, że obraz pochodzi z AI — to tylko jeden element układanki.
Czy AI potrafi wygenerować obraz zupełnie bez błędów?
Nowsze modele, takie jak Midjourney v7 czy Flux, mocno ograniczyły klasyczne wpadki z dłońmi i tekstem, ale przy uważnym oglądaniu wciąż widać subtelne niespójności w odbiciach, cieniach, powtarzalnych wzorach i fizyce światła. Z każdą kolejną wersją te ślady są rzadsze i mniej oczywiste, dlatego tym bardziej opłaca się łączyć metody weryfikacji.
Czym jest standard C2PA i dlaczego ma znaczenie?
C2PA (Coalition for Content Provenance and Authenticity) to standard techniczny wdrażany przez firmy takie jak Adobe, OpenAI, Google i Microsoft. Pozwala on zapisać w pliku kryptograficzny ślad pochodzenia obrazu — informację o tym, czy i w jaki sposób treść powstała lub została zmieniona przez AI. Znacznik „Content Credentials” jest jednym z najbardziej wiarygodnych sygnałów, choć nie towarzyszy jeszcze wszystkim obrazom generowanym na rynku.
Czy detektory AI działają na każdym rodzaju obrazu?
Nie w równym stopniu. Większość trenowano głównie na realistycznych zdjęciach i portretach, więc przy stylizowanych ilustracjach, grafice cyfrowej i mocno skompresowanych plikach wypadają słabiej. Skuteczność zależy też od tego, jaki model wygenerował obraz — detektory muszą być stale aktualizowane, żeby nadążać za nowymi generatorami.