Meta : l'IA traque les publicités liées à la pédocriminalité

Meta : l'IA traque les publicités liées à la pédocriminalité

Meta ajoute plusieurs nouveaux systèmes d'IA à ses dispositifs de protection de l'enfance sur Facebook et Instagram. Le plus marquant s'attaque à une tactique précise : des publicités d'apparence anodine qui renvoient vers des contenus pédocriminels hébergés ailleurs sur le Web.

L'entreprise a présenté ces outils mercredi, en même temps que de nouveaux chiffres de modération. Au premier semestre 2026, Meta affirme être intervenue sur 33,2 millions de contenus relevant de l'exploitation sexuelle d'enfants sur Facebook et Instagram. Selon l'entreprise, ses propres systèmes en ont repéré plus de 97 % avant tout signalement d'un utilisateur.

Meta a aussi publié un chiffre distinct pour l'Inde. Sur la même période, elle y a traité 5,3 millions de contenus de ce type, dont plus de 98 % détectés avant que des utilisateurs ne les signalent.

Le problème des publicités "propres"

Meta appelle cette tactique le "signposting", littéralement le "fléchage". Une publicité peut ne rien contenir d'illégal. Son texte et ses images peuvent sembler tout à fait banals. Le danger tient à sa destination. La publicité sert de porte d'entrée vers un site externe qui héberge des contenus pédocriminels ou facilite d'autres activités nuisibles.

Selon Meta, des acteurs malveillants ont commencé à recourir à cette méthode récemment, car ils ne cessent d'adapter leurs pratiques pour échapper à la détection. Un filtre qui se contente d'examiner le contenu d'une publicité passera à côté, puisque la publicité elle-même n'enfreint aucune règle.

Pour y remédier, Meta a mis au point un nouveau système fondé sur un grand modèle de langage (LLM) chargé de repérer ce fléchage. Le changement d'approche se résume simplement. Meta vérifie désormais où une publicité envoie les utilisateurs, et pas seulement ce qu'elle montre. Lorsqu'une destination enfreint ses règles, l'entreprise dit pouvoir bloquer le site ou le lien concerné et sanctionner les comptes à l'origine de la publicité.

Quatre autres changements

Le détecteur de fléchage s'inscrit dans un ensemble plus large de mises à jour :

1. Des analyses supplémentaires par IA. Meta multiplie les analyses menées par IA pour repérer les contenus d'exploitation que ses anciens systèmes auraient pu laisser passer. L'entreprise indique qu'elle ajoutera de nouveaux signaux à mesure qu'elle comprendra mieux le fonctionnement de ces réseaux.

2. Un agent de red teaming. Meta a conçu un agent d'IA qui attaque ses propres mesures de sécurité. Sa mission : trouver les failles que des agresseurs pourraient exploiter pour contourner les protections de l'entreprise. Meta explique vouloir découvrir les nouvelles méthodes d'abus avant qu'elles ne se répandent. Une démarche qui reflète une tendance plus large du secteur consistant à entraîner l'IA à attaquer et à défendre des systèmes.

3. Une meilleure détection des récidivistes. L'entreprise améliore sa capacité à repérer les personnes qui reviennent avec de nouveaux comptes après la suppression des anciens.

4. La poursuite du déploiement de nouvelles fonctions. Plus tôt cette année, Meta a ajouté un contrôle parental pour Meta AI, des comptes pour préadolescents sur WhatsApp et des alertes prévenant les parents lorsque leurs enfants recherchent sur Instagram des contenus liés à l'automutilation. En septembre, WhatsApp a donné davantage de contrôle aux parents. Ils peuvent limiter l'usage des Chaînes par les adolescents, décider qui voit leurs statuts, contrôler qui peut ajouter leurs enfants à des groupes et choisir de recevoir des notifications sur certaines activités de groupe.

La pression en toile de fond

Cette annonce intervient alors que Meta fait l'objet d'une surveillance constante en matière de protection de l'enfance. L'entreprise a été visée par des poursuites judiciaires et par les critiques d'élus sur les risques que ses réseaux sociaux pourraient faire peser sur les jeunes utilisateurs. En août, Meta a accepté de verser jusqu'à 18 milliards de dollars pour régler une action en justice sur la protection de l'enfance intentée par 29 États américains.

Notre analyse

L'outil de détection du fléchage illustre un vrai tournant dans la manière dont la modération des contenus doit fonctionner. Les agresseurs n'ont plus besoin de publier des contenus illégaux sur une plateforme. Il leur suffit que la plateforme y envoie du trafic. Les systèmes de sécurité doivent donc suivre les liens et évaluer les destinations, ce qui est plus difficile et plus coûteux que d'analyser des images ou du texte. Le recours à un LLM laisse penser que Meta considère cette tâche comme nécessitant du contexte et du raisonnement, et pas seulement une comparaison avec des contenus déjà connus.

L'agent de red teaming mérite lui aussi d'être suivi de près. Utiliser l'IA pour éprouver les défenses de l'IA devient courant dans tout le secteur, et la protection de l'enfance dans les produits d'IA fait l'objet d'une attention croissante, comme l'a montré une évaluation récente de ChatGPT pour les adolescents. Le chiffre de 97 % avancé par Meta mesure ce que l'entreprise a intercepté, pas ce qui lui a échappé. Reste à voir si elle publiera des données propres au fléchage, et si des chercheurs indépendants pourront vérifier l'efficacité réelle de ces outils.