Meta: KI-Tools gegen Anzeigen mit Links zu Kindesmissbrauch

Meta: KI-Tools gegen Anzeigen mit Links zu Kindesmissbrauch

Meta setzt beim Kinderschutz auf Facebook und Instagram mehrere neue KI-Systeme ein. Das auffälligste richtet sich gegen eine bestimmte Masche: Anzeigen, die harmlos wirken, Nutzer aber zu Darstellungen sexuellen Kindesmissbrauchs führen, die anderswo im Netz liegen.

Das Unternehmen stellte die Werkzeuge am Mittwoch zusammen mit neuen Zahlen zur Durchsetzung seiner Regeln vor. Im ersten Halbjahr 2026 ist Meta nach eigenen Angaben auf Facebook und Instagram gegen 33,2 Millionen Inhalte zur sexuellen Ausbeutung von Kindern vorgegangen. Mehr als 97 Prozent davon hätten die eigenen Systeme entdeckt, bevor ein Nutzer sie gemeldet habe.

Für Indien nannte Meta eine eigene Zahl. Dort ging das Unternehmen im selben Zeitraum gegen 5,3 Millionen solcher Inhalte vor, mehr als 98 Prozent davon wurden erkannt, bevor Nutzer sie meldeten.

Das Problem mit "sauberen" Anzeigen

Meta nennt die Masche "Signposting", also das Aufstellen von Wegweisern. Eine Anzeige muss nichts Illegales enthalten. Text und Bilder können ganz gewöhnlich aussehen. Der Schaden liegt darin, wohin sie führt. Die Anzeige dient als Tür zu einer externen Website, auf der Missbrauchsdarstellungen liegen oder andere schädliche Aktivitäten unterstützt werden.

Laut Meta greifen Täter erst seit Kurzem auf diese Methode zurück, weil sie ihr Vorgehen ständig anpassen, um nicht entdeckt zu werden. Ein Filter, der nur den Inhalt einer Anzeige prüft, übersieht sie, denn die Anzeige selbst verstößt gegen keine Regel.

Dagegen hat Meta ein neues System auf Basis eines großen Sprachmodells (LLM) entwickelt, das nach Signposting sucht. Der neue Ansatz ist schnell erklärt. Meta prüft jetzt, wohin eine Anzeige die Nutzer schickt, und nicht mehr nur, was sie zeigt. Verstößt das Ziel gegen die Regeln, kann das Unternehmen nach eigenen Angaben die Website oder den Link sperren und gegen die Konten vorgehen, die die Anzeige geschaltet haben.

Vier weitere Neuerungen

Der Signposting-Detektor gehört zu einem größeren Paket an Neuerungen:

1. Zusätzliche KI-Scans. Meta lässt mehr KI-gestützte Scans laufen, um Ausbeutungsinhalte zu finden, die frühere Systeme womöglich übersehen haben. Das Unternehmen will neue Signale ergänzen, je mehr es darüber lernt, wie diese Netzwerke arbeiten.

2. Ein Red-Teaming-Agent. Meta hat einen KI-Agenten gebaut, der die eigenen Schutzmaßnahmen angreift. Seine Aufgabe ist es, Schwachstellen zu finden, über die Täter die Schutzvorkehrungen des Unternehmens umgehen könnten. Ziel sei es, neue Missbrauchsmethoden zu entdecken, bevor sie sich verbreiten, so Meta. Das passt zu einem breiteren Trend in der Branche, KI für Angriff und Verteidigung zu trainieren.

3. Bessere Erkennung wiederkehrender Nutzer. Das Unternehmen verbessert die Erkennung von Personen, die mit neuen Konten zurückkehren, nachdem ihre alten gelöscht wurden.

4. Weitere neue Funktionen. Anfang des Jahres hat Meta Elternkontrollen für Meta AI, Konten für Kinder unter 13 auf WhatsApp und Warnungen eingeführt, die Eltern benachrichtigen, wenn Kinder auf Instagram nach Inhalten zu Selbstverletzung suchen. Im September hat WhatsApp Eltern mehr Kontrolle gegeben. Sie können einschränken, wie Jugendliche Kanäle nutzen, festlegen, wer deren Statusmeldungen sieht, bestimmen, wer ihre Kinder zu Gruppen hinzufügen darf, und sich über manche Gruppenaktivitäten benachrichtigen lassen.

Der Druck dahinter

Die Ankündigung kommt zu einer Zeit, in der Meta beim Kinderschutz anhaltend unter Beobachtung steht. Das Unternehmen sieht sich Klagen und Kritik von Abgeordneten ausgesetzt, weil seine sozialen Netzwerke für junge Nutzer gefährlich sein könnten. Im August erklärte sich Meta bereit, bis zu 18 Milliarden Dollar zu zahlen, um eine Kinderschutzklage von 29 US-Bundesstaaten beizulegen.

Unsere Einschätzung

Das Signposting-Werkzeug zeigt, wie grundlegend sich Inhaltsmoderation verändern muss. Täter müssen illegales Material nicht mehr auf einer Plattform posten. Es reicht, wenn die Plattform den Verkehr dorthin lenkt. Schutzsysteme müssen also Links folgen und Zielseiten bewerten, was schwieriger und teurer ist, als Bilder oder Texte zu scannen. Dass Meta hier ein LLM einsetzt, deutet darauf hin, dass das Unternehmen die Aufgabe als eine sieht, die Kontext und Schlussfolgerungen braucht und nicht nur den Abgleich mit bekannten Inhalten.

Auch der Red-Teaming-Agent verdient Aufmerksamkeit. KI einzusetzen, um KI-Abwehr auf die Probe zu stellen, wird in der Branche zur Regel, und der Kinderschutz in KI-Produkten steht zunehmend im Fokus, wie eine aktuelle Bewertung von ChatGPT für Jugendliche gezeigt hat. Metas 97-Prozent-Wert misst, was das Unternehmen gefunden hat, nicht, was ihm entgangen ist. Spannend wird, ob Meta gezielt Daten zum Signposting veröffentlicht und ob unabhängige Forscher überprüfen können, wie gut diese Werkzeuge tatsächlich funktionieren.