Obrazy z AI potrafią zmylić nawet wprawne oko. Midjourney, DALL-E 3, Stable Diffusion i Flux zrobiły w ostatnich dwóch latach taki postęp, że stary żart o liczeniu palców przestał wystarczać. Wciąż jednak istnieją powtarzalne tropy — techniczne i wizualne — które zdradzają sztuczne pochodzenie obrazu, także w najnowszych modelach. W tym poradniku nauczysz się analizować obraz warstwa po warstwie: od kompozycji, przez metadane ukryte w pliku, aż po najbardziej wiarygodne dziś narzędzia detekcyjne.
Dlaczego rozpoznawanie obrazów z AI stało się ważne
Jeszcze niedawno rozpoznanie obrazu z AI było ciekawostką techniczną. Dziś to praktyczna umiejętność, która wpływa na codzienne decyzje. Kupujący na platformach sprzedażowych chcą wiedzieć, czy „zdjęcie produktu” faktycznie pochodzi od sprzedawcy, czy jest generyczną grafiką z AI. Rekruterzy przyglądają się zdjęciom z LinkedIna i CV. Dziennikarze i fact-checkerzy weryfikują obrazy krążące w sieci, zanim je opublikują. Niestety, twarze z AI służą też do budowania przekonujących fałszywych profili w oszustwach matrymonialnych i kradzieżach tożsamości.
Skala problemu rosła razem z jakością modeli. W 2023 roku większość obrazów z AI miała oczywiste błędy w dłoniach i tekście. W 2026 modele takie jak Midjourney v7, Flux 1.1 Pro czy Gemini Image w większości przypadków trzymają poprawną anatomię, więc pobieżne oględziny coraz mniej dają. Bezpieczniej jest łączyć kilka tropów — wizualnych, technicznych i z narzędzi zewnętrznych — zamiast opierać się na jednej poszlace.
Warto to podkreślić: żadna z opisanych tu metod nie daje stuprocentowej pewności. Chodzi o zwiększenie trafności twojej oceny, a nie o zastąpienie krytycznego myślenia. Im więcej sygnałów wskazuje w tę samą stronę, tym pewniejszy wniosek.
Wizualne tropy, które wciąż zdradzają obraz z AI
Modele generatywne przewidują prawdopodobne piksele na podstawie wzorców statystycznych wyuczonych z milionów prawdziwych zdjęć. Dzięki temu świetnie radzą sobie z wiarygodną fakturą, ale wciąż potykają się tam, gdzie potrzebna jest sztywna spójność strukturalna — czyli przy rzeczach, które ludzki mózg liczy i sprawdza od dziecka, jak liczba palców czy symetria twarzy.
Dłonie, palce i stawy
To wciąż najczęściej wskazywana słabość, choć modele mocno się poprawiły. Sprawdź, czy palców nie jest za dużo albo za mało, czy stawy nie zginają się pod anatomicznie niemożliwym kątem i czy palce nie zlewają się ze sobą jak plastelina. Osobnym sygnałem są dłonie schowane za przedmiotem, w kieszeni albo pod włosami: generatory chętnie „chowają” to, co wychodzi im najgorzej.
Zęby, oczy i uszy
Zęby z AI bywają zbyt równym, jednolitym rzędem, bez drobnych nieregularności prawdziwego uzębienia. W oczach zdarzają się niespójne refleksy świetlne (catchlights) — blik w innym miejscu lub o innym kształcie w każdym oku, co przy jednym źródle światła fizycznie nie miałoby prawa się zdarzyć. Ucho z kolei ma złożoną budowę wewnętrzną (obrąbek, grobelka, skrawek), którą AI często upraszcza albo lekko zniekształca, zwłaszcza w ujęciach na trzy czwarte.
Włosy, tkaniny i powtarzalne wzory
Pojedyncze włosy zlewające się w jednolite bryły, wzór tkaniny (krata, paski) gubiący rytm w połowie ubrania albo kolczyki i naszyjniki różniące się między lewą a prawą stroną twarzy to powracające sygnały. AI rozumie „ideę” powtarzalnego wzoru, ale nie zawsze utrzymuje jego matematykę na całej powierzchni obrazu.
Tekst i typografia wewnątrz obrazu
Szyldy, napisy na koszulkach, etykiety produktów i tablice w tle to jeden z najsłabszych punktów. Nawet zaawansowane modele generują litery, które na pierwszy rzut oka wyglądają poprawnie, a z bliska okazują się znakami bez znaczenia — „prawie alfabetem”, który nie układa się w żadne prawdziwe słowa. To dziś jeden z najpewniejszych tropów.
Fizyka światła, cienia i odbicia
Cienie padające w inną stronę, niż sugerowałoby główne źródło światła, odbicia w szkle albo lustrze niepasujące do tego, co powinno się w nich znaleźć, oraz oświetlenie skóry rozmijające się ze światłem otoczenia to subtelne, ale powtarzalne poszlaki. Szczególnie uważnie oglądaj sceny z kilkoma źródłami światła (na przykład okno i lampa), bo tam AI najczęściej „miesza” cienie w sposób fizycznie niemożliwy.
Tło i kompozycja sceny
Zwróć uwagę na elementy tła zlewające się ze sobą bez wyraźnej granicy, przedmioty urwane bez powodu przy krawędzi kadru oraz dziwne powtórzenia — jak dwa niemal identyczne krzesła ustawione tak, jak w prawdziwym wnętrzu nikt by ich nie postawił. Rozmyte tło (bokeh) potrafi te niespójności zamaskować, więc właśnie rozmytym obszarom warto przyjrzeć się uważniej.
💡 Wskazówka: powiększ obraz co najmniej dwukrotnie i przyjrzyj się rogom oraz krawędziom — to tam modele najczęściej gubią drobne detale, bo ich „uwaga” skupia się na środku kompozycji.
Faktura skóry i problem nadmiernej perfekcji
Prawdziwe zdjęcia noszą drobne niedoskonałości: widoczne pory, delikatny meszek na twarzy, lekkie asymetrie, różnice tonu wynikające z naczyń krwionośnych tuż pod skórą. Obrazy z AI — zwłaszcza portrety „studyjne” — to wszystko wygładzają, tworząc niemal woskową powierzchnię, jak równo nałożony podkład o mocnym kryciu. Efekt jest najbardziej widoczny na jasnej cerze w bezpośrednim świetle, gdzie brak naturalnych różnic rzuca się w oczy.
Trzeba jednak pamiętać, że ten sam efekt daje mocne wygładzanie skóry filtrami (standard w aplikacjach aparatu w telefonie), więc lepiej traktować go jako wzmocnienie innych tropów niż jako samodzielny dowód.
Metadane EXIF: co zdradzają ukryte dane pliku
Każde zdjęcie z aparatu cyfrowego albo smartfona ma wbudowaną w plik warstwę danych technicznych zwaną EXIF (Exchangeable Image File Format). Znajdziesz tam model aparatu lub telefonu, rodzaj obiektywu, przysłonę, czas naświetlania, ISO, dokładną datę i godzinę wykonania zdjęcia, a często też współrzędne GPS.
Obrazy z AI wyeksportowane wprost z narzędzia zwykle nie mają tych pól wypełnionych albo zawierają ogólne informacje o programie generującym zamiast danych prawdziwego aparatu. Sprawdzisz to szybko narzędziem Usuń EXIF, które wyświetla wszystkie metadane pliku, zanim zdecydujesz, czy je usunąć, czy zostawić.
Content Credentials i inicjatywa C2PA
Ważnym i coraz istotniejszym krokiem naprzód jest standard C2PA (Coalition for Content Provenance and Authenticity), wdrażany m.in. przez Adobe, OpenAI, Google, Microsoft i Leicę. Obrazy powstałe w zgodnych narzędziach dostają znacznik „Content Credentials” — kryptograficzny zapis pochodzenia pliku, zawierający także informację, czy treść wygenerowała lub edytowała AI. Nie każdy obraz go jeszcze ma, ale jeśli jest, to jedna z najpewniejszych dostępnych dziś poszlak.
💡 Wskazówka: sam brak metadanych niczego nie dowodzi — serwisy społecznościowe, WhatsApp i większość aplikacji do edycji też je usuwają, przetwarzając i ponownie kompresując zdjęcie przed zapisem lub wysyłką. Traktuj to jako jeden z sygnałów, nigdy jako samodzielny dowód.
Automatyczne detektory: co jest dziś dostępne
Poza analizą własnym okiem istnieją wyspecjalizowane serwisy, które używają własnych modeli AI do wykrywania statystycznych wzorców pikseli niewidocznych dla człowieka — subtelnych podpisów zostawianych przez modele generatywne. Żaden nie jest nieomylny, ale świetnie sprawdzają się jako druga opinia, zwłaszcza w połączeniu z opisaną wyżej analizą wizualną.
| Narzędzie | Jak działa | Najlepsze zastosowanie |
|---|---|---|
| Hive Moderation | Klasyfikator trenowany na milionach oznaczonych obrazów | Szybkie sprawdzenie przez wgranie pliku lub API |
| Illuminarty | Analiza statystyczna wzorców pikseli i kompresji | Zdjęcia i grafika cyfrowa |
| AI or Not | Połączenie kilku klasyfikatorów | Sprawdzanie wielu obrazów naraz |
| Google SynthID | Niewidoczny znak wodny wtapiany przy generowaniu (gdy dotyczy) | Obrazy tworzone w produktach Google |
| Optic (od AI or Not) | Detekcja nastawiona na twarze i portrety | Sprawdzanie profili i awatarów |
Ważna uwaga: te narzędzia analizują wzorce statystyczne, które modele generatywne z każdą wersją starają się zacierać. Skuteczność detekcji zmienia się więc w czasie — narzędzie wykrywające 95% obrazów ze Stable Diffusion 1.5 może wypaść znacznie gorzej przy najnowszym Fluxie. Dlatego zawsze warto uruchomić więcej niż jeden detektor, zanim wyciągniesz wnioski.
Wyszukiwanie wsteczne jako uzupełnienie
Wyszukiwanie wsteczne w Google Lens albo TinEye potrafi dać cenny kontekst: pokaże, czy ten sam obraz pojawił się już gdzie indziej z innym podpisem, czy ktoś wcześniej uznał go za syntetyczny, a czasem nawet wskaże prawdziwe zdjęcie, które posłużyło za bazę do edycji przez AI (w oszustwach częsty jest schemat: wziąć czyjeś prawdziwe zdjęcie i „ulepszyć” je generatywnie).
Ta metoda szczególnie przydaje się przy podejrzanych zdjęciach profilowych w aplikacjach randkowych i serwisach społecznościowych, bo wiele fałszywych kont wykorzystuje — z edycją AI albo bez niej — zdjęcia prawdziwych osób bez ich zgody.
Jak potykają się poszczególne generatory
Każdy model ma własne „podpisy błędów”, wynikające ze zbioru treningowego i decyzji architektonicznych. Znajomość tych różnic pomaga dopasować analizę do prawdopodobnego pochodzenia obrazu.
| Generator | Najczęstszy błąd | Mocna strona |
|---|---|---|
| Midjourney | Zbyt idealne kompozycje, woskowa skóra w portretach | Bardzo przekonująca estetyka i światło |
| DALL-E 3 | Tekst prawie czytelny, ale błędny, lekko przesycone barwy | Dobre rozumienie złożonych promptów |
| Stable Diffusion (starsze wersje) | Zniekształcone dłonie, asymetryczne oczy | Elastyczność i dostosowanie przez LoRA |
| Flux | Tła z subtelnie powtarzalnymi wzorami | Znacznie spójniejsza anatomia i dłonie |
| Gemini Image / Imagen | Odbicia i cienie bywają niespójne w złożonych scenach | Fotorealizm w prostych scenach |
Ta tabela nie jest sztywną regułą — modele aktualizują się często i charakterystyczne dziś błędy mogą zniknąć w kolejnej wersji. Mimo to podpowiada, gdzie zajrzeć najpierw, gdy podejrzewasz konkretny obraz.
Praktyczne sytuacje, w których to naprawdę się liczy
Zakupy na platformach sprzedażowych: zanim uwierzysz podejrzanie idealnemu zdjęciu produktu w ogłoszeniu z drugiej ręki, sprawdź metadane, spójność tła i to, czy drobiazgi (metki, szwy, faktury) mają fizyczny sens.
Weryfikacja dziennikarska: fact-checkerzy łączą wyszukiwanie wsteczne, analizę metadanych i detektory, zanim potwierdzą autentyczność obrazu krążącego wiralowo w czasie kryzysu albo ważnych wydarzeń.
Profile w social mediach i aplikacjach randkowych: zdjęcie profilowe w podejrzanie idealnym studyjnym świetle, brak jakiejkolwiek historii postów i unikanie rozmowy wideo to sygnały, które w połączeniu z tropami AI powinny wzmóc czujność.
Rekrutacja i HR: część firm już sprawdza, czy zdjęcie z CV albo LinkedIna nie powstało sztucznie, w ramach ostrzejszej weryfikacji tożsamości.
Typowe błędy przy wykrywaniu obrazów z AI
Częsty błąd to traktowanie jednego sygnału jak rozstrzygającego dowodu — na przykład odrzucenie prawdziwego zdjęcia tylko dlatego, że nie ma EXIF (a mogło go stracić, przechodząc przez WhatsAppa). Drugi to ślepa wiara w wynik jednego detektora, mimo że one także się mylą: dają fałszywe alarmy (prawdziwe zdjęcie uznane za AI) i przeoczenia (niewykryty świeży obraz syntetyczny).
Łatwo też przecenić własne oko: badania pokazują, że bez wsparcia narzędzi większość osób trafia z rozpoznaniem obrazów z AI mniej więcej na poziomie przypadku, gdy model jest nowy i dobrej jakości. Dlatego łączenie metod zawsze wypada pewniej niż poleganie na „wprawnym oku”.
Jest jeszcze trzeci częsty błąd: pomijanie kontekstu, w jakim obraz krąży. Zdjęcie bez możliwego do ustalenia źródła, bez wcześniejszej historii publikacji i opatrzone mocno emocjonalnym podpisem (na przykład wezwaniem do pilnego udostępnienia) zasługuje na większą nieufność niż obraz opublikowany przez zweryfikowane konto o spójnej historii — niezależnie od tropów technicznych w samym pliku. Pochodzenie i sposób rozprzestrzeniania są w praktyce równie ważne jak analiza piksel po pikselu.
Na koniec warto pamiętać, że obrazy bywają częściowo generowane przez AI — prawdziwe zdjęcie z podmienionym tłem, usuniętym przedmiotem albo cyfrowo zmienionym ubraniem. W takich przypadkach mieszanych tropy AI skupiają się w jednym miejscu kadru (zwykle tam, gdzie nastąpiła zmiana), zamiast rozkładać się równomiernie po całej scenie, jak przy obrazach w pełni syntetycznych.
Szybka lista kontrolna dla podejrzanego obrazu
- Powiększ obraz i sprawdź dłonie, zęby, uszy i biżuterię pod kątem asymetrii lub zniekształceń.
- Przyjrzyj się tekstowi i literom w kadrze — szyldom, etykietom, tablicom.
- Sprawdź, czy światło i cienie zgadzają się z widocznymi źródłami oświetlenia.
- Zajrzyj w metadane EXIF pliku narzędziem Usuń EXIF w ImageTools.
- Przepuść obraz przez co najmniej jeden automatyczny detektor (Hive, Illuminarty albo AI or Not).
- Zrób wyszukiwanie wsteczne, żeby poznać kontekst i pochodzenie obrazu.
Żaden punkt z tej listy nie musi rozstrzygać sam z siebie — wartość bierze się z sumowania poszlak. Obraz, który przechodzi czysto przez cztery czy pięć z nich, jest znacznie bardziej prawdopodobnie autentyczny niż taki, który budzi wątpliwości w kilku miejscach naraz.
Sprawdź metadane dowolnego obrazu
Użyj narzędzia Usuń EXIF w ImageTools, aby zajrzeć w ukryte dane pliku, zanim go udostępnisz albo mu zaufasz.
Sprawdź metadane teraz