← Tous les guides Sous le capot

Ce qu'une carte thermique régionale montre qu'un score ne peut pas révéler

Un seul chiffre résume trois situations différentes en une seule réponse. La vue par vignette les sépare, et la différence détermine généralement ce que vous faites ensuite.

· 8 min de lecture · Best AI Image Detector

Que l'ensemble de l'image soit synthétique ou qu'une partie d'une vraie photographie ait été modifiée. Ce sont des problèmes différents aux conséquences différentes, et un score unique les traite de la même manière.

Le problème d'un chiffre unique

Considérez deux images. La première est entièrement générée et chaque partie en est synthétique. La seconde est une véritable photographie d'une pièce réelle avec une fissure ajoutée sur un mur.

Un modèle analysant l'image entière réduit chacune à une valeur unique. La première obtient un score élevé, à juste titre. La seconde obtient un score bas, car les huit neuvièmes proviennent d'un appareil photo, et la moyenne occulte la modification.

La seconde image est celle qui coûte de l'argent à quelqu'un. C'est la réclamation d'assurance, le reçu falsifié, la photo d'annonce modifiée, l'image d'actualité dont un détail a été changé. Un outil qui renvoie un chiffre unique l'effacera.

Les trois motifs

Une fois l'image découpée en vignettes et notée, trois formes apparaissent, et chacune signifie quelque chose de différent.

Chaque carreau est chaud

91 94 89 96 93 90 88 95 92

La cohérence est la signature. Les vraies photographies n'obtiennent presque jamais des scores aussi réguliers, car les scènes réelles présentent des textures variées.

Une image entièrement générée. Aucune partie de cette image ne provient d'un appareil photo, donc aucune vignette n'est froide.

Une vignette élevée, le reste froid

14 11 16 12 88 13 9 15 10

Les vignettes froides sont de véritables captures d'appareil photo. Celle qui est chaude ne l'est pas. C'est le motif qu'un nombre unique détruit.

Une véritable photographie avec un objet inséré. Le score de l'image entière était de 31, ce qui aurait été interprété comme probablement réel.

Uniformément tiède, rien de chaud

58 61 54 63 59 57 55 62 60

Uniformément moyen. Le traitement global élève tout un peu et rien beaucoup, ce qui est l'empreinte de logiciels plutôt que d'une fabrication.

Une véritable photographie ayant subi un traitement lourd : mode nuit, réduction du bruit, puis recompressions.

Comment lire correctement une carte

  1. Regarder la dispersion avant le pic

    L'écart entre la vignette la plus élevée et la plus basse importe plus que la valeur maximale. Un écart important indique une modification locale ; un écart étroit indique ce qui est arrivé à l'ensemble du cadre.

  2. Vérifier si les vignettes chaudes sont adjacentes

    Les modifications réelles sont contiguës, car les objets le sont. Deux vignettes chaudes côte à côte constituent une insertion plausible. Deux aux coins opposés ne le sont généralement pas.

  3. Comparer avec l'image

    Regardez ce qui se trouve réellement dans la région chaude. Si elle contient les dégâts, le prix, le visage ou l'objet en litige, c'est significatif. Si elle contient un ciel vide, ce n'est probablement pas le cas.

  4. Ignorer les vignettes avec peu de détails

    Les zones unies de ciel, de mur ou d'eau portent moins de signal et obtiennent des scores moins fiables. Une vignette chaude recouvrant un mur vide mérite moins de poids qu'une autre recouvrant un objet détaillé.

  5. Traiter les conflits comme de l'incertitude

    Un score d'image bas avec plusieurs vignettes chaudes dispersées relève généralement de la compression plutôt que de la modification. C'est une raison pour trouver une meilleure copie, et non pour couper la poire en deux.

Lorsqu'aucune carte n'est générée

En dessous d'environ 576 pixels sur le côté le plus court, l'image ne peut pas être divisée en régions avec suffisamment de détails pour être notée indépendamment. Vous obtenez uniquement un chiffre pour l'ensemble de l'image.

C'est une réelle limitation pour les vignettes, les photos de profil et les images tirées d'applications de chat, qui sont malheureusement les supports par lesquels arrivent un grand nombre d'images suspectes. Trouver une copie plus grande de la même image constitue généralement la prochaine étape la plus utile.

Pourquoi cela compte plus que la précision

Améliorer un modèle d'image globale de 91 à 93 pour cent change très peu de choses pour quelqu'un qui vérifie la photo d'une réclamation. Pouvoir voir qu'un coin de l'image se comporte différemment du reste modifie totalement la conclusion.

La vue par région rend également un résultat explicable, ce qui importe chaque fois qu'une décision doit être justifiée par la suite. Un modérateur, un gestionnaire de sinistres ou un éditeur peut pointer du doigt une partie spécifique d'une image et expliquer pourquoi il y a regardé de plus près. Personne ne peut faire cela avec un pourcentage.

Pourquoi des vignettes qui se chevauchent plutôt qu'une simple grille

Une grille naïve présente une faiblesse qui apparaît immédiatement en pratique. Une modification située sur une frontière est divisée entre deux vignettes, et chacune ne perçoit que la moitié des indices face à une vignette complète de pixels authentiques. Les deux reviennent modérées, et le constat disparaît.

Le chevauchement des découpes résout ce problème. Chaque point de l'image se trouve entièrement dans au moins une région, de sorte qu'une petite insertion est évaluée par rapport à une vignette qu'elle domine plutôt qu'une qu'elle partage. Le coût est l'exécution du modèle un plus grand nombre de fois, ce qui sur un appareil local prend une seconde et non une facture.

Cela explique également pourquoi les vignettes adjacentes s'illuminent souvent ensemble. Un seul objet inséré qui se trouve à cheval sur deux régions qui se chevauchent élève les deux, ce qui explique pourquoi l'adjudication est un signal de soutien plutôt que le signe de deux modifications distinctes.

La conséquence pratique est que le nombre de vignettes varie avec la forme d'une image. Un panorama large est divisé différemment d'un portrait carré, et les dimensions de la grille sont indiquées avec chaque résultat afin que vous puissiez voir avec quelle précision l'image a été découpée.

Questions fréquentes

Que montre une carte thermique sur un détecteur d'images IA ?
La façon dont le signal synthétique est réparti sur l'ensemble de l'image plutôt qu'au moyenné de celle-ci. Chaque vignette est notée individuellement par le même modèle, ce qui vous permet de voir si l'image entière semble générée ou si une seule partie l'est. Ces deux conclusions signifient des choses très différentes.
Une région chaude signifie-t-elle que cette partie a définitivement été modifiée ?
Non. Cela signifie que le modèle y a trouvé le signal le plus fort. Des zones unies, une compression importante dans un coin ou une région avec une texture inhabituelle peuvent toutes élever une vignette sans qu'aucun montage n'ait eu lieu. Traitez cela comme un indicateur pour regarder de vos propres yeux, et non comme une conclusion.
Pourquoi le score de l'image entière est-il inférieur à celui de la vignette la plus élevée ?
Parce qu'il est calculé sur l'ensemble de l'image plutôt que de correspondre au maximum des vignettes. Une grande zone authentique tire la lecture globale vers le bas. C'est précisément la raison pour laquelle les deux chiffres sont communiqués au lieu d'un seul.
Combien de régions sont notées ?
Cela dépend de la forme et de la taille de l'image, généralement entre six et douze vignettes se chevauchant. Les dimensions de la grille sont affichées avec le résultat afin que vous puissiez voir avec quelle finesse l'image a été divisée.
Puis-je utiliser la carte pour prouver quelle partie a été modifiée ?
Non, et c'est l'exagération la plus fréquente. La carte montre où un signal statistique est concentré, ce qui ne constitue pas le contour d'une manipulation. Elle aide un être humain à examiner attentivement une zone spécifique ; elle ne constitue pas une conclusion en soi.
Et si chaque bloc est différent sans aucun motif ?
Cela signifie généralement que l'image a subi suffisamment de traitements pour que le signal régional se résume à du bruit. Des valeurs éparses sans contiguïté ni lien avec le contenu indiquent que le fichier ne permet pas une lecture fiable.