Двете ленти
Един детекът изпълнява две независими проверки и те отговарят на различни неща. Тяхното разделяне е най-полезният концепт на тази страница.
Пикселен анализ
- Работи след екранни снимки и компресия
- Връща вероятност, а не самоличност
- Независим от генератора по дизайн
- Не може да назове инструмент
- Влошава се при неизследвани архитектури
Файлови доказателства
- Може да назове инструмента точно
- Криптографски при подписване
- Премахва се от почти всяка платформа
- Липсва в повечето изображения
- Лесно се премахва умишлено
Какво може да декларира един файл
Когато дадено изображение все още носи оригиналната си структура, могат да присъстват няколко вида маркери. Всеки от тях е твърдение, направено от софтуера, който го е записал, а не нещо, изведено от пикселите.
- Content Credentials. Подписан манифест, който назовава инструмента и какво е направил той. Някои големи генератори вече подписват своите резултати, което е най-силната форма на това.
- Параметри на генериране. Няколко отворени инструмента вграждат промпта, сийда, семплера и името на модела директно във файла, което е повече информация, отколкото повечето хора очакват да намерят.
- Софтуерни идентификатори. Обикновено поле за метаданни, указващо приложението, което последно е запазило изображението.
- Декларирани AI водни знаци. Флаг, указващ, че е бил приложен невидим воден знак, което е декларация, а не самият воден знак.
- Утвърждения за заснемане от камера. Обратното твърдение, направено от камера с възможност за подписване, че файлът идва от сензор.
Всички те изчезват в момента, в който дадено изображение бъде качено на която и да е платформа. Ето защо сканирането на файл си струва да се пусне и никога не си струва да се разчита на него: когато намери нещо, откритието е силно, а през повечето време то не намира нищо.
Защо назоваването на генератора е трудно
Звучи така, сякаш би трябвало да е възможно. Различните инструменти произвеждат различна естетика и човек, който прекарва време с тях, често може да познае правилно. Тази интуиция не се пренася към детектора поради три причини.
Моделите споделят архитектури и обучителни данни, така че техните статистически отпечатъци се припокриват силно. Много инструменти са фино настроени версии на една и съща основа, което ги прави почти неразличими на ниво текстура, дори когато резултатите им изглеждат различно за човек.
Резултатите също така се обработват допълнително. Мащабирането, възстановяването на лица и редактирането се случват след генерирането и презаписват точно текстурата, от която би зависела идентификацията. До момента, в който едно изображение бъде публикувано, то може да носи повече от мащабиращата програма, отколкото от генератора.
А целта се променя постоянно. Всеки модел за идентификация е таблица за справки с неща, които вече са съществували, което го прави грешен по отношение на всичко, пуснато след обучението му, по начин, който е тих, вместо очевиден.
Какво всъщност означава добро покритие
Полезният въпрос за един детектив не е кои генератори разпознава по име. Той е колко широко е било обучението, защото широчината е това, което предсказва представянето на модела, който все още не е пуснат на пазара.
| Подход | Сила | Слабост |
|---|---|---|
| Обучение върху няколко основни търговски инструмента | Висока точност при тези инструменти | Слабо обобщаване към всичко останало |
| Обучение върху хиляди генератори | Обобщава се към неизследвани модели | По-ниска пикова точност за който и да е отделен инструмент |
| Търсене на артефакт от една архитектура | Много високо, докато трае | Провали се напълно, когато методът се промени |
| Четене само на файлови маркери | Точно, когато присъстват | Сляпо при мнозинството изображения |
Вторият ред е подходът, използван тук, и компромисът е умишлен. Детектор, който е отличен с четири продукта и безполезен с петия, не върши много работа за проверка на изображение, което някой ви е изпратил.
Относно продуктовите имена
Списъците с поддържани генератори са по-скоро маркетингов артефакт, отколкото технически. Пикселният модел няма списък; той има обучително разпределение. Назоваването на продукти подсказва възможност за всеки отделен инструмент, каквато широкомащабната детекция няма и от която не се нуждае.
Където все пак се появява име в резултат тук, то идва от файла, а не от пикселите, и резултатът го показва. На това различие струва да се държи при всеки инструмент, който използвате.
Как да тълкувате твърдение за покритие
Доставчиците описват покритието по начини, които звучат съпоставимо, но не са. Три фрази се появяват многократно и всяка от тях означава нещо различно.
Засича изображения от X, Y и Z обикновено означава, че бенчмаркът е съдържал тези трите. Това е изявление за тестването, а не за възможностите, и не казва нищо за четвъртия генератор.
Поддържа над четиридесет генератора обикновено означава, че обучителният набор е черпил от толкова източници. Това е по-смислено, защото широчината на обучението е това, което предсказва обобщаването, но все пак не е гаранция за някой конкретен инструмент.
Установяването на изходния модел е най-трудното твърдение за доказване. Задайте си въпроса дали това установяване идва от файла или от пикселите. Ако идва от пикселите, поискайте точността на установяването отделно от точността на засечката, тъй като това са съвсем различни числа.