← Tous les guides Sous le capot

Deepfake vs généré par AI : il ne s'agit pas du même problème

L'un invente une personne qui n'existe pas. L'autre place une personne réelle là où elle n'a jamais été. Ils nécessitent des vérifications différentes, et les confondre conduit à de réelles erreurs.

· 9 min de lecture · Best AI Image Detector

Une image générée invente son sujet. Un deepfake conserve l'identité d'une personne réelle et modifie ce qu'elle semble faire. Le second est celui qui nuit à une personne spécifique, et c'est le plus difficile à détecter des deux, car la majeure partie du cadre est authentique.

Deux choses différentes que l'on désigne par le même terme

Une image entièrement générée part de rien. Il n'y a pas de photographie sous-jacente, pas de lecture de capteur, pas de moment qui s'est produit. Chaque pixel a été produit par un modèle, et la personne qui s'y trouve n'a aucune identité à diffamer puisqu'il n'y a personne.

Un deepfake part de quelque chose de réel. Il y a une photographie ou une vidéo sous-jacente, une capture authentique d'un moment authentique, et un modèle a remplacé une région spécifique de celle-ci, généralement un visage, par le rendu de quelqu'un d'autre.

Cette distinction revêt une importance juridique, éditoriale et technique. Une photo d'illustration générée d'un médecin inexistant relève du droit d'octroi de licence. Une photographie d'un vrai médecin dont le visage a été collé sur un corps auquel il n'a jamais appartenu relève de la diffamation, et potentiellement du pénal.

Photo d'illustration générée Portrait AI de vous-même Fausse célébrité générée Photo avec visage permuté Document altéré
Quelle part du cadre est réelle → ↑ Préjudice envers une personne spécifique
Les positions sont données à titre indicatif. Les axes sont ce qui importe : le préjudice suit l'identité, pas le degré de synthétisme des pixels.
Où se situe chaque élément. Le quadrant inférieur droit concentre les préjudices graves.

Pourquoi le deepfake est plus difficile à repérer

Un détecteur lit la texture statistique d'une image et indique dans quelle mesure elle ressemble à ce qu'un modèle a produit. Lorsque toute l'image est synthétique, ce signal est omniprésent et le score ne prête pas à confusion.

Une permutation de visage inverse le problème. Quatre-vingt-dix pour cent de l'image est une vraie photographie, avec un vrai bruit de capteur et un historique de compression réel, et la moyenne de l'image entière reflète cela. Une permutation convaincante peut produire un score autour de trente sur une image qui est pourtant trompeuse.

Ce n'est pas tant un échec du modèle qu'un échec de la question. Demander si l'image est générée n'a pas de sens lorsque la réponse honnête est que la majeure partie ne l'est pas, mais qu'une partie importante l'est.

16 12 19 14 11 91 17 13 15 18 12 16

La moyenne qui a produit 33 est précisément ce qui cache la seule zone qui compte.

Une vraie photographie dont un visage a été remplacé. Le score global de l'image était de 33 et ne disait presque rien.

La carte des régions est la réponse à ce problème de formulation. Analyser des zones qui se chevauchent séparément signifie qu'un remplacement localisé est mesuré par rapport à son propre voisinage plutôt que d'être dilué dans une image à laquelle il n'appartient pas.

Le vocabulaire, dans l'ordre d'apparition

Les termes utilisés par les gens et ce que chacun décrit réellement
TermeCe que cela signifieLe sujet est-il réel ?
DeepfakeL'apparence d'une personne réelle transposée dans une autre séquenceOui
Permutation de visageLa forme courante d'un deepfake, sur une image fixe ou une vidéoOui
Généré par IAProduit à partir d'une consigne sans photographie sourceNon
Modifié par IAUne vraie photo avec un élément ajouté ou suppriméGénéralement
Média synthétiqueTerme générique englobant tout ce qui précèdeDépend
CheapfakeMédia réel détourné par une légende, un recadrage ou une date ancienneOui

La dernière ligne mérite que l'on s'y attarde, car c'est la forme la plus courante de désinformation visuelle et celle qu'aucun détecteur ne traite. Une photographie authentique et non modifiée prise dans un autre pays il y a trois ans, présentée comme l'actualité d'aujourd'hui, obtiendra le score de la vraie photographie qu'elle est.

Que faire concrètement, selon les cas

  1. Vous suspectez que toute l'image est inventée. Effectuez une vérification globale de l'image. Un score élevé avec une carte uniforme est on ne peut plus clair.
  2. Vous suspectez qu'une personne a été insérée ou permutée. Lisez d'abord la carte des régions. Le chiffre sous-estimera la situation.
  3. Vous suspectez qu'un document a été altéré. Idem que ci-dessus, et attendez-vous exactement à une zone chaude sur le champ modifié.
  4. Vous suspectez que la légende ment. Un détecteur ne peut pas aider. Faites une recherche d'image inversée, puis vérifiez la date et le lieu.
  5. Il s'agit d'une vidéo. C'est un outil entièrement différent. L'analyse d'images fixes image par image rate les artefacts temporels qui trahissent les permutations en temps réel.

Pourquoi cette distinction protège les personnes

Traiter chaque image synthétique avec le même degré de gravité entraîne deux échecs à la fois. Cela gaspille de l'attention sur des choses inoffensives, comme quelqu'un qui utilise un portrait généré faute de pouvoir s'offrir un photographe, et cela minimise le cas qui nuit réellement à une personne.

Le préjudice ne réside pas dans le fait que les pixels sont artificiels. Il réside dans le fait qu'une personne réelle et nommée est montrée en train de faire quelque chose qu'elle n'a pas fait. C'est cela qu'il faut signaler, et c'est le cas où un score moyen est le moins digne de confiance en tant que résumé.

Concevoir une politique interne autour de l'identité plutôt qu'autour de la technologie permet également de mieux traverser le temps. Les méthodes continueront de changer ; la question de savoir si une personne spécifique est présentée de manière erronée ne changera pas.

Comment une permutation de visage est réellement réalisée

Comprendre la production aide à expliquer la détection. Une permutation commence par une photographie cible et un ensemble d'images de la personne dont le visage sera utilisé. Un modèle apprend à restituer ce visage sous l'éclairage, l'angle et l'expression déjà présents dans la cible.

Le visage rendu est ensuite intégré dans l'image d'origine, et la jointure est la partie difficile. Les deux moitiés ont un bruit différent, un historique de compression différent et souvent une réponse des couleurs légèrement différente, de sorte que l'étape de fusion adoucit la limite jusqu'à ce que l'œil ne remarque plus le raccord.

C'est cet adoucissement que lit une carte des régions. La fusion supprime la texture haute fréquence produite par un capteur, et la zone obtenue est statistiquement différente de tout ce qui l'entoure, même lorsque le raccord est invisible. La jointure est invisible et mesurable à la fois.

Cela explique également pourquoi une permutation réussit si facilement une vérification globale de l'image. La zone manipulée est petite, délibérément fondue dans son environnement et entourée d'une photographie authentique qui domine toute moyenne prise sur l'ensemble de l'image.

L'erreur qui se répète sans cesse

Les gens passent un deepfake suspect dans un détecteur, voient un score dans les trente et en concluent que l'image est authentique. C'est la mauvaise déduction à partir du bon chiffre : le score est correct et la question à laquelle il répond n'a jamais été celle que l'on se posait.

L'habitude qui corrige cela est simple. Sur toute image où l'on s'interroge sur une personne spécifique, ouvrez la carte des régions avant de lire le chiffre principal, et traitez la zone la plus élevée plutôt que la moyenne comme le résultat sur lequel agir.

Questions fréquentes

Toute image IA est-elle un deepfake ?
Non, et la différence réside dans le sujet. Un deepfake utilise l'apparence d'une personne réelle sans son implication, ce qui le rend préjudiciable et souvent illégal. Une image générée de quelqu'un qui n'existe pas n'a pas de victime, et traiter les deux de la même manière gaspille de l'attention sur le cas inoffensif.
Cet outil peut-il détecter un deepfake ?
Sur une image fixe, souvent oui, grâce à la carte des régions plutôt qu'au chiffre. Un visage permuté est un remplacement localisé à l'intérieur d'une photographie authentique, il apparaît donc comme une zone chaude dans une grille par ailleurs neutre, tandis que le score global reste bas. Lisez d'abord la carte sur toute image représentant une personne.
Qu'en est-il des vidéos de deepfake ?
Cela nécessite des outils différents. La manipulation vidéo laisse des artefacts temporels, des incohérences entre des images consécutives, que le modèle d'image fixe ne recherche pas. L'analyse d'images individuelles permettra d'en attraper certaines et passera à côté de celles conçues pour résister précisément à ce type de vérification.
Pourquoi un deepfake connu a-t-il obtenu un score bas ?
Parce qu'il s'agit en grande partie d'une vraie photographie. Le score global fait la moyenne sur l'ensemble de l'image, et un visage occupant un huitième de l'image modifie très peu cette moyenne. C'est la manière la plus fréquente dont les gens interprètent mal un résultat sur une image modifiée.
Un cheapfake est-il détectable ?
Non par un détecteur, car il n'y a rien de synthétique à détecter. Une vraie photographie accompagnée d'une fausse légende est un problème de traçabilité : faites une recherche d'image inversée pour trouver les copies antérieures, puis vérifiez si la date et le lieu correspondent à l'affirmation avancée.
La loi les traite-t-elle différemment ?
De plus en plus, oui. Plusieurs juridictions ont introduit des infractions couvrant spécifiquement les représentations synthétiques non consensuelles de personnes réelles, en particulier les images intimes, tandis que les images générées de personnes anonymes sont traitées selon les règles ordinaires. Consultez votre propre équipe juridique plutôt que de vous fier à cette page.