Deepfakes et vérification : les meilleurs outils pour le journalisme d'investigation
Les modèles de détection indiquent qu'un fichier est probablement synthétique. La provenance dit d'où il vient. Un seul des deux résiste au contre-interrogatoire, et ce n'est pas celui qui affiche un score de confiance.
Le réflexe, face à une vidéo suspecte, consiste à la passer dans un détecteur et à lire le pourcentage. C'est précisément ce réflexe qui pose problème. Un détecteur renvoie une probabilité issue d'un modèle entraîné sur les techniques de génération d'hier, et sa fiabilité se dégrade silencieusement face à toute méthode plus récente. Une vérification qui tient se construit dans l'autre sens : établir d'où vient le fichier, et n'utiliser la détection que pour départager.
La chaîne de vérification, dans l'ordre
Les rédactions efficaces suivent une séquence, pas un outil. Chaque étape coûte moins cher que la suivante : l'ordre importe davantage que le logiciel.
- Retrouver la copie la plus ancienne. Recherche d'image inversée sur des images clés extraites, via plusieurs moteurs. La plupart des « deepfakes » sont en réalité des images authentiques d'un autre lieu ou d'une autre époque : de la décontextualisation, pas de la synthèse.
- Lire le fichier, pas la copie de plateforme. Obtenez l'original auprès de la source. Le réencodage des plateformes supprime les métadonnées : une copie téléversée ne dit presque rien de l'origine.
- Vérifier les signaux de provenance. Les Content Credentials C2PA, lorsqu'ils existent, consignent l'appareil de capture et l'historique des modifications dans un manifeste signé. Leur absence ne prouve rien ; leur présence est forte.
- Géolocaliser et dater. Bâtiments, enseignes, ombres, relevés météo, végétation. C'est lent, et c'est ce qui tient réellement dans un litige de correction.
- Interroger la cohérence interne. Reflets, mains, synchronisation labiale image par image, ambiance sonore, boucles d'arrière-plan.
- Passer les détecteurs en dernier. Comme un signal parmi d'autres, jamais comme la conclusion.
- Contacter la source et la personne concernée. Toujours l'étape la plus rentable, et la plus souvent sautée sous la pression du bouclage.
Les outils à avoir
| Outil | Usage | Limite | Coût |
|---|---|---|---|
| InVID-WeVerify | Extraction d'images clés, recherche inversée, métadonnées, loupe | Flux lié au navigateur | Gratuit |
| Moteurs de recherche inversée | Repérage de la copie la plus ancienne | Couverture très variable selon moteur et région | Gratuit |
| C2PA / Content Credentials | Provenance signée de capture et d'édition | Ne fonctionne que si la chaîne l'a préservée | Vérification gratuite |
| Forensically / FotoForensics | Analyse du niveau d'erreur, détection de clonage, bruit | Facile à surinterpréter ; simplement indicatif | Gratuit |
| Plateformes de détection | Scores de classification des médias synthétiques | Se dégradent face aux nouveaux générateurs ; faux positifs sur vidéo compressée | Commercial |
| Ressources de géolocalisation | Satellite, imagerie de rue, relief, position du soleil | Très chronophage | Majoritairement gratuit |
| Services d'archivage | Capture horodatée avant suppression | À faire immédiatement | Gratuit |
Pourquoi la détection est le maillon faible
Trois problèmes structurels limitent la valeur probante d'un classificateur. Les détecteurs sont entraînés sur des méthodes connues et perdent en précision face aux techniques apparues après leur entraînement. Compression, réencodage et traitement des plateformes introduisent des artefacts ressemblant à une manipulation, produisant des faux positifs sur des images parfaitement authentiques passées par plusieurs applications. Et la course est asymétrique : un générateur n'a qu'à tromper les détecteurs existants, tandis qu'un détecteur doit généraliser à des générateurs qui n'existent pas encore.
La conséquence éditoriale mérite d'être inscrite dans une charte : un score de détection n'est jamais la conclusion. Il peut justifier un travail supplémentaire et appuyer un résultat obtenu autrement. Il ne peut pas porter un article à lui seul.
Ce que change la provenance
Les Content Credentials inversent la question. Au lieu de demander à un modèle si les pixels paraissent synthétiques, la provenance demande ce que le fichier déclare de lui-même et si cette déclaration est cryptographiquement intacte. Quand le manifeste survit, il consigne l'appareil de capture, les modifications et les outils employés : une chaîne vérifiable plutôt qu'une probabilité.
La limite est honnête et importante : un manifeste absent ne prouve rien. La plupart des appareils ne signent pas, la plupart des plateformes suppriment les métadonnées, et il suffit de refilmer un écran pour tout effacer. La provenance est une preuve forte quand elle existe et aucune preuve quand elle manque : elle complète les techniques classiques au lieu de les remplacer.
Construire la chaîne avant d'en avoir besoin
Le scénario d'échec est prévisible : une rédaction bricole un processus de vérification en pleine actualité, sous pression, pendant que la concurrence publie. Décidez à l'avance qui est habilité à déclarer un contenu vérifié, quel est le niveau de preuve minimal, et quelle formulation employer lorsque vous publiez un élément que vous ne pouvez pas confirmer entièrement. Entraînez-vous sur des documents anciens dont la réponse est connue. Les outils s'apprennent en un après-midi ; c'est le protocole éditorial qui évite l'erreur.
Note méthodologique. Les capacités des outils évoluent vite et les taux de précision annoncés par les éditeurs sont généralement mesurés sur des jeux de données de référence plutôt que sur du matériel adversarial réel. Maniez ces chiffres avec prudence et retestez régulièrement vos outils face aux techniques de génération actuelles.
Sources
Les affirmations de cet article reposent sur les documents ci-dessous. Chacun est présenté avec ce qu'il établit, afin que vous puissiez vérifier n'importe quelle assertion à sa source plutôt que de nous croire sur parole.
- C2PA, spécification technique des Content Credentials (v2.4) — le format de provenance cryptographique lui-même — ce que contient réellement une assertion de vérification
- C2PA, explication de la spécification — la version lisible, incluant le cas d'usage en rédaction
- Content Credentials — le versant grand public : comment un lecteur inspecte l'historique d'un fichier
- Coalition for Content Provenance and Authenticity — gouvernance et membres — qui est engagé par la norme
Questions fréquentes
Quel est le meilleur outil de détection de deepfake ?
Il n'existe pas de détecteur fiable unique, et considérer un score comme une preuve est l'erreur de vérification la plus répandue. Les plateformes commerciales sont utiles comme signal parmi d'autres, mais elles se dégradent face aux techniques plus récentes que leurs données d'entraînement et produisent des faux positifs sur des vidéos très compressées.
Comment un journaliste vérifie-t-il une vidéo suspecte ?
Par une séquence, pas par un outil : extraire des images clés et rechercher la copie la plus ancienne, obtenir le fichier original auprès de la source plutôt qu'une copie réencodée, contrôler les identifiants de provenance, géolocaliser et dater la scène, examiner la cohérence interne, puis contacter la source et la personne concernée. Les détecteurs viennent en dernier.
Que sont les Content Credentials C2PA ?
Un manifeste signé cryptographiquement attaché à un fichier média, consignant l'appareil de capture et l'historique des modifications. Lorsque la chaîne le préserve, il fournit une provenance vérifiable plutôt qu'une estimation probabiliste. Son absence ne prouve rien : la plupart des appareils ne signent pas et la plupart des plateformes suppriment les métadonnées.
La plupart des faux viraux sont-ils générés par IA ?
Non. L'essentiel des contenus trompeurs en circulation est constitué d'images authentiques privées de contexte : de vraies vidéos prises à une autre date, dans un autre lieu ou lors d'un autre événement. La recherche d'image inversée résout plus de cas que n'importe quel détecteur, d'où sa place en première étape.
Que faire avant une crise ?
Écrire le protocole à l'avance : qui peut déclarer un contenu vérifié, quel niveau de preuve est exigé, et quelle formulation employer pour publier un élément non pleinement confirmé. Entraînez-vous sur des archives dont la réponse est connue. Le logiciel s'apprend en une après-midi ; ce sont les règles de décision qui préviennent l'erreur.