← Wszystkie poradniki Poradniki

Jak odczytać wynik detektora obrazów AI

Co oznacza ta liczba, jak działa pięć przedziałów, kiedy mapa obszarów unieważnia główny wynik oraz w którym momencie uczciwą odpowiedzią jest niepewność.

· 6 min czytania · Best AI Image Detector

Wynik jest prawdopodobieństwem, a nie dowodem. Przeczytaj najpierw przedział, potem mapę obszarów, a następnie własne poświadczenia pliku. Te trzy elementy razem odpowiadają na pytanie, na które sama liczba nie jest w stanie odpowiedzieć.

Zacznij od opublikowanego przedziału

Liczba nie ma znaczenia bez skali. Oto pięć zastosowanych tutaj przedziałów, stałych i opublikowanych, dzięki czemu wartość 72 dzisiaj oznacza to samo, co 72 w zeszłym tygodniu. Linia decyzyjna znajduje się na poziomie 65.

  • Brak sygnału AI 0–20
  • Prawdopodobnie prawdziwe 20–45
  • Niepewny 45–65
  • Prawdopodobnie AI 65–90
  • Wysokie prawdopodobieństwo AI 90–100
Wynik bliski linii decyzyjnej jest mniej rozstrzygający niż wynik na którymkolwiek z krańców. Wynika to ze właściwości skali, a nie z błędu w wyniku.

Najpierw przeczytaj mapę regionów

Główny wynik kompresuje cały kadr do jednej liczby. Mapa regionów ocenia zachodzące na siebie obszary osobno, a wzorzec występujący w tych kafelkach niesie ze sobą informacje, które pojedyncza liczba niszczy.

Jak czytać obie te wartości razem
WzorzecCo to zazwyczaj oznaczaCo należy zrobić
Wysoki wynik, większość kafelków gorącychW całości wygenerowany kadrPotraktuj główny wynik jako wiarygodny
Niski wynik, jeden kafelek gorącyPrawdziwe zdjęcie z czymś dodanym lub usuniętymPrzyjrzyj się tej części zdjęcia samodzielnie
Niski wynik, wiele kafelków gorącychSprzeczne dowodyPotraktuj jako niepewne i sprawdź oryginalny plik
Brak wygenerowanej mapy regionówObraz jest zbyt mały, aby go podzielićZnajdź większą kopię przed podjęciem decyzji
25 22 46 35 64 84 44 65

Dwa kafelki na linii decyzyjnej lub powyżej niej wewnątrz w przeciwnym razie chłodnego kadru. Ten podział to właśnie wygląd lokalnej edycji.

Prawdziwa fotografia z wstawionym obiektem. Główny wynik wynosił 38, co w odosobnieniu wskazywałoby na obraz prawdopodobnie prawdziwy.

Przyznaj większą wagę własnym danym uwierzytelniającym pliku

Gdy obraz zawiera prawidłowy manifest C2PA, ta część wyniku ma charakter kryptograficzny, a nie statystyczny. Podpisane dane uwierzytelniające powiązane z bieżącymi pikselami stanowią silniejszy dowód niż jakikolwiek wynik.

Brak danych uwierzytelniających nie oznacza niczego. Większość obrazów nigdy ich nie posiadała, a metadane są usuwane przez prawie każdą platformę podczas przesyłania. Traktuj brak manifestu jako brak informacji, a nie jako sygnał negatywny.

Spodziewaj się, że kompresja zmieni tę liczbę

Zrzuty ekranu, pobrania z platform społecznościowych, mocna kompresja JPEG, skalowanie w górę oraz filtry – wszystko to zmienia wyniki, zazwyczaj w kierunku środka. Sprawdź plik o najwyższej możliwej jakości, zamiast polegać na zrzucie ekranu czy miniaturze.

Dokładność spada w miarę ponownej kompresji obrazu
Czyste oryginały
91.3 %
Jakość JPEG 60
87.3 %
Jakość JPEG 40
84.6 %

Oś zaczyna się od 80%. Te dane pochodzą z opublikowanego benchmarku badawczego modelu, a nie z obrazów napływających z otwartego internetu.

Zrównoważona dokładność względem jakości JPEG w opublikowanym benchmarku modelu. Oś zaczyna się od 80, aby nachylenie było widoczne.

Podejmuj decyzję z uwzględnieniem kontekstu

  1. Sprawdź przedział oraz odległość od linii

    Wyniki 66 i 96 znajdują się powyżej linii decyzyjnej, ale oznaczają zupełnie co innego.

  2. Porównaj główny wynik z mapą regionów

    Zgodność wzmacnia interpretację. Niezgodność oznacza brak pewności, a nie wyciąganie średniej.

  3. Przeczytaj dowody z pliku

    Content Credentials oraz znaczniki generatora, jeśli występują, stanowią odrębne dowody o innej wadze.

  4. Zweryfikuj źródło oraz historię publikacji

    Wyszukiwanie obrazu w odwrotnej kolejności w celu znalezienia najwcześniejszej kopii rozstrzyga więcej spraw niż jakikolwiek wynik.

  5. Nikogo nie oskarżaj na podstawie pojedynczego zautomatyzowanego wyniku

    Przeczytaj stronę dotyczącą dokładności i ograniczeń, zanim wynik cokolwiek zmieni dla prawdziwego człowieka.

Czego wynik Ci nie powie

Cztery pytania, na które użytkownicy zasadniczo oczekują odpowiedzi od wyniku, a na żadne z nich nie odpowiada.

  • Które narzędzie stworzyło obraz. Wynik pikselowy to prawdopodobieństwo, że zaangażowane było coś generatywnego, a nie identyfikacja. Tylko dane uwierzytelniające lub osadzony znacznik mogą wskazać generator, a większość plików nie posiada żadnego z nich.
  • Kto go stworzył. Nic w obrazie nie powiązuje go z konkretną osobą. Wynik nie może stanowić podstawy oskarżenia wobec jednostki, a prezentowanie go tak, jakby mógł, stanowi najczęstsze nadużycie.
  • Czy treść jest prawdziwa. Fotografia może być w pełni autentyczna, a mimo to przedstawiać coś ustawionego, błędnie opisanego lub zrobionego lata wcześniej w innym kraju. Autentyczność pikseli to nie to samo co prawdziwość twierdzenia.
  • Jak duża część obrazu została zmieniona. Mapa regionów pokazuje, gdzie sygnał jest najsilniejszy, a nie granice modyfikacji. Gorący kafelek wskazuje, gdzie należy spojrzeć własnymi oczami.

Świadomość tego, do czego liczba nie jest zdolna, pozwala na użycie jej pozostałej części. Narzędzie do wykrywania zdobywa zaufanie dzięki jasnemu określeniu swoich granic, a nie poprzez brzmienie w sposób pewny siebie.

Gdy dwa odczyty są ze sobą sprzeczne

Sprzeczne dowody zdarzają się często i nie stanowią usterki. Niski wynik główny z kilkoma gorącymi kafelkami zazwyczaj oznacza silną kompresję, a nie modyfikację, ponieważ kompresja niszczy jedne części kadru bardziej niż inne. Wysoki wynik główny z równą, niepozorną mapą regionów często oznacza, że cały obraz został poddany obróbce, a nie wygenerowany: przeskalowany, odszumiony lub przepuszczony przez filtr, który odbudował drobne detale wszędzie naraz.

W obu przypadkach rozwiązaniem jest powrót do pliku źródłowego. Prawie każda sprzeczność w wyniku wynika z kopii, która została dostarczona, a nie z samego obrazu, a wersja, która przeszła przez o jedną platformę mniej, zazwyczaj rozwiązuje ten problem.

Często zadawane pytania

Czy wynik 100 oznacza, że obraz na pewno został stworzony przez AI?
Nie. Górny przedział oznacza, że wzorce pikseli pasują do wygenerowanych przykładów w stopniu zbliżonym do tego, co model widział wcześniej, co stanowi silny dowód, a nie dowód bezsporný. Ilustracje, renderowanie 3D oraz mocno przetworzona fotografia studyjna mogą osiągnąć górny przedział bez udziału modelu generatywnego.
Co oznacza wynik 50?
Że obraz nie może dostarczyć pewnej odpowiedzi, zazwyczaj dlatego, że kompresja, kadrowanie lub zmiana rozmiaru usunęły szczegóły, które odczytuje model. Jeśli to możliwe, znajdź oryginalny plik. Jeśli 50 to wszystko, co obraz może zaoferować, właściwym wnioskiem jest stwierdzenie, że nic nie wiesz.
Dlaczego mapa regionów się nie pojawiła?
Obraz był zbyt mały, aby podzielić go na znaczące kafelki. Wszystko poniżej około 576 pikseli na krótszym boku otrzymuje wyłącznie wynik dla całego kadru. Większa kopia tego samego zdjęcia zazwyczaj generuje jedno i drugie.
Czy powinienem ufać wynikowi, czy mapie regionów?
Żadnemu z nich w odosobnieniu. Odpowiadają one na różne pytania: wynik pyta, czy kadr wygląda na wygenerowany, a mapa – które jego części tak wyglądają. Kiedy są ze sobą sprzeczne, ta sprzeczność jest samym rezultatem, a właściwym wnioskiem jest to, że obraz wymaga bliższego przyjrzenia się, a nie wydania werdyktu.
Dwa wykrywacze dały mi różne wyniki. Który jest właściwy?
Być może żaden, a sama niezgodność niesie ze sobą informacje. Wykrywacze są trenowane na różnych danych i wyznaczają linie decyzyjne w różnych miejscach, więc wynik 55 z jednego narzędzia i 75 z innego mogą opisywać ten sam odczyt tego samego obrazu. Porównaj przedziały, a nie liczby, i przyznaj większą wagę temu narzędziu, które pokaże Ci swoje dowody.