Meta AI-tools pakken advertenties naar kindermisbruik aan

Meta AI-tools pakken advertenties naar kindermisbruik aan

Meta zet een reeks nieuwe AI-systemen in voor de bescherming van kinderen op Facebook en Instagram. Het opvallendste systeem richt zich op een specifieke tactiek: advertenties die onschuldig lijken, maar mensen doorsturen naar materiaal van seksueel kindermisbruik dat elders op het web staat.

Het bedrijf maakte de tools woensdag bekend, samen met nieuwe handhavingscijfers. Volgens Meta heeft het in de eerste helft van 2026 op Facebook en Instagram maatregelen genomen tegen 33,2 miljoen stukken content met seksuele uitbuiting van kinderen. Meer dan 97% daarvan werd volgens het bedrijf door de eigen systemen gevonden voordat een gebruiker er melding van maakte.

Meta gaf ook een apart cijfer voor India. Daar trad het in dezelfde periode op tegen 5,3 miljoen stukken van zulke content, waarvan meer dan 98% werd opgespoord voordat gebruikers het meldden.

Het probleem met "schone" advertenties

Meta noemt de tactiek "signposting". Een advertentie bevat misschien niets illegaals. De tekst en de beelden kunnen er heel gewoon uitzien. Het kwaad zit in waar de advertentie naartoe leidt. Ze werkt als toegangspoort tot een externe website met misbruikmateriaal of andere schadelijke activiteiten.

Volgens Meta gebruiken kwaadwillenden deze methode sinds kort, omdat ze hun aanpak steeds aanpassen om niet ontdekt te worden. Een filter dat alleen controleert wat er in een advertentie staat, mist dit, want de advertentie zelf overtreedt geen enkele regel.

Om dat aan te pakken heeft Meta een nieuw systeem gebouwd op basis van een groot taalmodel (LLM) dat naar signposting zoekt. De verandering in aanpak is eenvoudig uit te leggen. Meta controleert nu waar een advertentie gebruikers naartoe stuurt, en niet alleen wat de advertentie laat zien. Als een bestemming de regels overtreedt, kan het bedrijf naar eigen zeggen die website of link blokkeren en optreden tegen de accounts achter de advertentie.

Vier andere veranderingen

De signposting-detector maakt deel uit van een bredere reeks updates:

1. Extra AI-scans. Meta voert meer AI-gestuurde scans uit om uitbuitingscontent op te sporen die eerdere systemen mogelijk hebben gemist. Het bedrijf zegt nieuwe signalen toe te voegen naarmate het meer leert over hoe deze netwerken werken.

2. Een red-teaming-agent. Meta heeft een AI-agent gebouwd die de eigen veiligheidsmaatregelen aanvalt. Die moet zwakke plekken vinden waarmee misbruikers de beveiliging van het bedrijf kunnen omzeilen. Volgens Meta is het doel om nieuwe misbruikmethoden te ontdekken voordat ze zich verspreiden. Dat past in een bredere beweging in de sector om AI te trainen in het aanvallen en verdedigen van systemen.

3. Betere herkenning van terugkerende gebruikers. Het bedrijf verbetert de manier waarop het mensen herkent die met nieuwe accounts terugkomen nadat hun oude accounts zijn verwijderd.

4. Verdere uitrol van functies. Eerder dit jaar voegde Meta ouderlijk toezicht toe voor Meta AI, accounts voor preteens op WhatsApp en meldingen die ouders waarschuwen als kinderen op Instagram zoeken naar content over zelfbeschadiging. In september gaf WhatsApp ouders meer controle. Ze kunnen beperken hoe tieners Kanalen gebruiken, bepalen wie hun statusupdates ziet, regelen wie hun kinderen aan groepen mag toevoegen en ervoor kiezen meldingen te krijgen over bepaalde groepsactiviteit.

De druk erachter

De aankondiging komt op een moment dat Meta al langere tijd onder vuur ligt vanwege de veiligheid van kinderen. Het bedrijf kreeg te maken met rechtszaken en kritiek van wetgevers over de risico's die zijn sociale media voor jonge gebruikers kunnen opleveren. In augustus stemde Meta ermee in tot 18 miljard dollar te betalen om een rechtszaak over kinderveiligheid te schikken die door 29 Amerikaanse staten was aangespannen.

Onze analyse

De signposting-tool laat zien dat contentmoderatie echt anders moet werken. Misbruikers hoeven geen illegaal materiaal meer op een platform te plaatsen. Het is genoeg als het platform verkeer naar dat materiaal stuurt. Veiligheidssystemen moeten dus links volgen en bestemmingen beoordelen, en dat is lastiger en duurder dan beelden of tekst scannen. Dat Meta hier een LLM voor inzet, wijst erop dat het bedrijf dit ziet als een taak die context en redeneervermogen vraagt, niet alleen het vergelijken met bekende content.

Ook de red-teaming-agent is het volgen waard. AI gebruiken om AI-verdedigingen te testen wordt in de hele sector gangbaar, en de veiligheid van kinderen in AI-producten ligt steeds meer onder een vergrootglas, zoals een recente beoordeling van ChatGPT voor tieners liet zien. Het cijfer van 97% van Meta meet wat het bedrijf heeft opgespoord, niet wat het heeft gemist. Het is de moeite waard om te volgen of het bedrijf specifiek cijfers over signposting gaat publiceren, en of onafhankelijke onderzoekers kunnen controleren hoe goed deze tools werken.