Meta entfernt 33,2 Mio. Missbrauchs-Inhalte; viele wurden automatisiert gefunden.
In Kürze
- 97% automatisch entdeckt
- LLM erkennt irreführende Links
- Red‑teaming & Ban-Check
Meta hat angekündigt, in der ersten Hälfte 2026 gegen insgesamt 33,2 Millionen Inhalte vorgegangen zu sein, die Kindesmissbrauch zeigen — verteilt auf Facebook und Instagram. Mehr als 97 % dieser Inhalte seien laut Firma von automatischen Systemen entdeckt worden, bevor Nutzerinnen oder Nutzer sie meldeten. In Indien entfielen 5,3 Millionen der Fälle; dort wurden über 98 % ebenfalls vor Nutzer‑Meldungen gefunden.
Neue KI‑Werkzeuge sollen Umleitungen erkennen
Um Täterpraktiken zu bekämpfen, mit denen Missbrauchsmaterial außerhalb der Plattformen weiterverbreitet wird, führt Meta neue KI‑Werkzeuge ein. Zentral ist ein neues Large‑Language‑Model (LLM), das so genanntes „Signposting“ aufspüren soll — also Anzeigen oder Beiträge, die harmlos wirken, aber zu Webseiten oder Angeboten führen, auf denen illegaler Missbrauch gezeigt wird. Meta prüft künftig nicht nur den sichtbaren Anzeigeninhalt, sondern auch, wohin die Anzeige verlinkt; Zielseiten können gesperrt und die dahinterstehenden Konten sanktioniert werden.
Erweiterte Scans und ständige Anpassung
Neben dem LLM setzt Meta auf erweiterte KI‑Scans, um Ausbeutungsinhalte zu finden, die frühere Systeme übersehen haben. Die Firma will fortlaufend neue Hinweise (Signale) ergänzen, sobald sich Täterstrategien ändern — ein System, das laut Meta laufend „mitlernt“, welche Muster problematisch sind.
KI testet KI: Red‑Teaming und Rückkehrer‑Erkennung
Ein weiteres neues Werkzeug ist ein sogenannter „red‑teaming KI‑agent“: eine KI, die Metas eigene Schutzmechanismen auf Schwachstellen prüft, indem sie mögliche Missbrauchsszenarien simuliert. Parallel verbessert Meta die Erkennung von Personen, die nach einer Sperre mit neuen Konten zurückkehren (sogenannte Ban‑Evasion).
Maßnahmen vor dem Hintergrund von Kritik und Rechtsstreit
Die Ankündigungen stehen im Kontext zunehmenden Drucks auf Meta wegen Kindersicherheit. Im August hatte sich das Unternehmen bereit erklärt, bis zu 18 Milliarden US‑Dollar zur Beilegung einer Klage von 29 US‑Bundesstaaten zu zahlen. Kritik und juristischer Gegenwind haben Meta in diesem Jahr bereits dazu veranlasst, mehrere Schutzfunktionen einzuführen.
Weitere Schutzfunktionen dieses Jahres
Unter den Neuerungen 2026 sind unter anderem:
- Elternkontrollen für Meta AI
- spezielle Vor‑Teen‑Konten auf WhatsApp
- automatische Benachrichtigungen an Eltern, wenn Kinder bei Instagram nach Selbstverletzung suchen
Im September ergänzte WhatsApp weitere Elternfunktionen:
- Einschränkungen für die Nutzung von Channels durch Teens
- Kontrolle darüber, wer Statusmeldungen sehen kann
- Regeln dafür, wer Kinder zu Gruppen hinzufügen darf
- Möglichkeit, über bestimmte Gruppenaktivitäten informiert zu werden
Quellen
- Quelle: Meta
- Der ursprüngliche Artikel wurde hier veröffentlicht
- Dieser Artikel wurde im Podcast KI-Briefing-Daily behandelt. Die Folge kannst du hier anhören.




