← Всички ръководства Точност

Защо AI детекторите не са съгласни за същото изображение

Прекарайте една картина през четири инструмента и получете четири отговора. Причините са структурни и тяхното познаване ви показва на кой резултат да вярвате.

· 7 мин. четене · Best AI Image Detector

Различни данни за обучение, различни линии на решение и различни определения за това какво се брои за AI. Два инструмента могат да разчетат изображение по идентичен начин и все пак да докладват противоположни присъди.

Четирите причини резултатите да се различават

Резултатът е краят на дълга верига от избори. Променете която и да е връзка и числото се измества, въпреки че нищо в изображението не се е променило.

  1. Различни данни за обучение. Детекторът разпознава това, което е видял. Един, обучен на хиляди отворени генератори, се справя добре с необичайни модели. Един, обучен на четирите най-големи търговски инструмента, се справя с тези четири по-добре и с всичко останало по-зле.
  2. Различни линии на решение. Един инструмент определя 60 като съмнително, друг определя 75 като съмнително. Същото отчитане пресича един праг, а друг – не, така че получавате две присъди от едно измерване.
  3. Различни определения. Някои инструменти отчитат всякаква генеративна намеса, включително мащабиране или генеративно запълване. Други отбелязват само напълно синтетични кадри. Ретушираният портрет е AI за първия и реален за втория.
  4. Различна предварителна обработка. Инструментите оразмеряват, изрязват и прекодират преди оценяването. Детектор, който чете квадрат с размери 224 пиксела от центъра, вижда различна картина от този, който чете 384 пиксела от целия кадър.
Същата фотография, оценена по четири начина
Инструмент А, линия на 50
61
Инструмент Б, линия на 65
58
Инструмент В, само цял кадър
34
Инструмент Г, отчита всяка корекция
88

Илюстративни фигури, показващи разпространение, типично за силно обработена, но истинска фотография.

Едно изображение, четири инструмента. Нищо тук не е неизправност: всяко от тях докладва какво казва собствената му скала.

Инструмент Г не е по-чувствителен от останалите. Той отговаря на по-широк въпрос. Ако вашата грижа е дали една фотография е била инсценирана от генератор, Г надвишава отчетите. Ако вашата грижа е дали какъвто и да е AI е докоснал файла, Г е единственият, който ви отговаря.

Попитайте на какъв въпрос отговаря всеки инструмент

Три въпроса, които хората имат предвид под "дали това е AI"
ВъпросътКакво го отбелязваТипична употреба
Генериран ли е този кадър от нищото?Синтетична текстура на целия кадърНовини, обяви на пазара, запознанства
Редактирана ли е някоя част от това от AI?Един регион над линиятаЗастраховки, претенции, преглед на доказателства
Докоснал ли е изобщо някакъв AI този файл?Мащабиране, премахване на шум, генеративно запълванеБиблиотеки за стокови изображения, правила за състезания

Повечето несъгласия между инструментите всъщност са несъгласие относно това за кое от тези трите сте попитали. Преди да сравнявате резултатите, решете кой въпрос има значение за вас, след това прочетете всеки инструмент спрямо него.

Как да сравните два резултата правилно

  1. Подайте на двата инструмента идентичния файл

    Не повторно изтегляне, не екранна снимка, не копие, което е преминало през приложение за чат. Различните байтове са различно изображение и законно ще получат различен резултат.

  2. Сравнявайте ленти, а не числа

    Число 61 на скала с линия на 50 и 58 на скала с линия на 65 не са съгласни относно присъдата, докато са съгласни относно отчитането.

  3. Търсете публикуван праг

    Инструмент, който не казва къде стои неговата линия, не може да се сравнява с нищо. Третирайте числото като неинтерпретируемо, а не като доказателство.

  4. Предпочитайте инструмента, който показва работата си

    Карта на регионите, назована лента и посочен бенчмарк ви позволяват да проверите обосновката. Уверен етикет без нищо зад него – не.

  5. Третирайте съгласието като силен сигнал

    Два независими инструмента, достигащи една и съща лента, струват повече от който и да е от тях сам по себе си. Двама несъгласни означава несигурно, а не разделяне на разликата.

Когато несъгласието е констатацията

Един модел заслужава да се научите да разпознавате. Инструмент, който отчита нисък резултат за целия кадър заедно с друг, който отчита висок резултат, често означава, че изображението е истинска снимка с локална корекция.

Първият инструмент усреднява корекцията върху предимно истински кадър. Вторият преценява най-силния регион. И двамата са прави за това, което са измерили, и самото несъгласие ви е казало повече от всяко число.

11 14 9 13 89 12 10 8 15

Едно поле над линията на решение вътре в иначе студен кадър. Никое единично число не улавя това.

Изгледът на регионите разрешава спора. Средната стойност за целия кадър на тези полета е 24, което се чете като чисто; картата показва защо това е подвеждащо.

Какво би накарало детекторите да се съгласят

Споделен бенчмарк, публикувани линии на решение и договорено определение за това какво се брои за намеса на AI биха премахнали по-голямата част от разпространението. Нито едно от тези неща все още не съществува и има малък търговски натиск да бъдат създадени, защото инструмент, който публикува слабостите си, изглежда по-зле от този, който не го прави.

Докато това не се промени, третирайте всяка оценка като идваща от частна скала. Прочетете доказателствата, които инструментът ви показва, и ги претеглете по-сериозно от увереността в неговия етикет.

Проблемът с версиите, който никой не споменава

Детекторът не е едно нещо с течение на времето. Доставчиците преобучават, коригират прагове и сменят модели без предизвестие и почти никой от тях не номерира версиите на своя изход. Резултатът, който сте получили през март, и резултатът, който получавате днес, може да идват от различни модели с различно калибриране зад тях.

Това е от значение, ако записвате резултати. Досие по иск, дневник за модерация или академичен случай, който цитира резултат от преди осемнадедесет месеца, цитира измерване, чийто инструмент вече не съществува. Няма начин да се възпроизведе и няма начин да се провери какво е означавало по това време.

Когато запазвате резултати, запазвайте доказателствата към тях: оценките на регионите, диапазона, границата на решение и датата. Те остават разбираеми, след като моделът зад тях е обновен, за разлика от едноличния процент.

Въпроси, които хората задават

Ако два детектора не са на едно мнение, на кой да вярвам?
Този, който ви показва аргументите си. Обявена граница на решение, именуван диапазон и карта на регионите ви позволяват да проверите дали отчитането има смисъл за вашето изображение. Едноличният процент от инструмент, който не казва какво означава, не е доказателство, колкото и самоуверено да звучи.
Дали пускането на повече детектори дава по-добър отговор?
Само ако предварително решите как да ги претеглите. Три инструмента, които са на едно мнение, наистина тежат повече от един. Шест инструмента, от които два са на вашето мнение, са начин хората да се убедят в изключение, до което вече са стигнали.
Защо единият инструмент нарича редактираната ми снимка ИИ, а друг я нарича истинска?
Те отговарят на различни въпроси. Инструмент, който отчита каквото и да е участие на генеративен модел, отбелязва генеративно запълване или повишаване на мащаба. Инструмент, който търси само изцяло синтетични кадри, не го прави. Нито един от тях не греши; проверете коя дефиниция използва всеки от тях.
Могат ли два детектора да бъдат прави едновременно?
Да, и това е често срещано. Различните прагове означават, че едно и също измерване води до различни заключения, а различните обучителни комплекти водят до наистина различни отчитания за необичайно изображение. Съгласуваността в диапазона е това, което има значение, а не съгласуваността в цифрите.