Meta usa IA contra anuncios que enlazan a abuso infantil

Meta usa IA contra anuncios que enlazan a abuso infantil

Meta está incorporando varios sistemas de IA nuevos a su trabajo de protección infantil en Facebook e Instagram. El más llamativo se centra en una táctica concreta: anuncios de apariencia inofensiva que llevan a material de abuso sexual infantil alojado en otro lugar de la red.

La compañía presentó estas herramientas el miércoles junto con nuevas cifras de aplicación de sus normas. Según Meta, en el primer semestre de 2026 actuó contra 33,2 millones de contenidos de explotación sexual infantil en Facebook e Instagram. La empresa asegura que sus propios sistemas detectaron más del 97 % de ese contenido antes de que ningún usuario lo denunciara.

Meta también ofreció una cifra aparte para la India. Allí actuó contra 5,3 millones de contenidos de este tipo en el mismo periodo, y más del 98 % se detectó antes de que los usuarios lo señalaran.

El problema de los anuncios "limpios"

Meta llama a esta táctica "signposting" (señalización). Un anuncio puede no contener nada ilegal. Su texto y sus imágenes pueden parecer normales. El daño está en el destino. El anuncio funciona como puerta de entrada a una web externa que aloja material de abuso o da soporte a otras actividades dañinas.

Meta explica que los delincuentes han empezado a usar este método hace poco, ya que van ajustando su forma de actuar para no ser detectados. Un filtro que solo revisa lo que contiene un anuncio no lo verá, porque el anuncio en sí no incumple ninguna norma.

Para hacerle frente, Meta ha creado un nuevo sistema basado en un modelo de lenguaje de gran tamaño (LLM) que rastrea este tipo de señalización. El cambio de enfoque es fácil de explicar. Meta ya no se limita a comprobar lo que muestra un anuncio, sino también adónde envía a los usuarios. Cuando un destino incumple sus normas, la compañía afirma que puede bloquear esa web o ese enlace y actuar contra las cuentas que publicaron el anuncio.

Otros cuatro cambios

El detector de señalización forma parte de un paquete de novedades más amplio:

1. Análisis adicionales con IA. Meta está realizando más análisis basados en IA para detectar contenido de explotación que sus sistemas anteriores pudieran haber pasado por alto. La compañía dice que irá añadiendo nuevas señales a medida que conozca mejor cómo funcionan estas redes.

2. Un agente de red teaming. Meta ha creado un agente de IA que ataca sus propias medidas de seguridad. Su función es encontrar puntos débiles que los abusadores podrían aprovechar para sortear las protecciones de la empresa. Según Meta, el objetivo es descubrir nuevos métodos de abuso antes de que se extiendan. Esto refleja una tendencia más amplia en el sector hacia entrenar a la IA para atacar y defender sistemas.

3. Mejor detección de usuarios reincidentes. La compañía está mejorando la forma de identificar a quienes vuelven con cuentas nuevas después de que se eliminaran las anteriores.

4. Más funciones en camino. A principios de este año, Meta añadió controles parentales para Meta AI, cuentas para preadolescentes en WhatsApp y alertas que avisan a los padres cuando sus hijos buscan contenido sobre autolesiones en Instagram. En septiembre, WhatsApp dio a los padres más controles. Pueden limitar cómo usan los adolescentes los Canales, decidir quién ve sus actualizaciones de estado, controlar quién puede añadir a sus hijos a grupos y optar por recibir notificaciones sobre parte de la actividad en los grupos.

La presión de fondo

El anuncio llega en un momento en que Meta está sometida a un escrutinio constante en materia de protección infantil. La compañía se ha enfrentado a demandas y a críticas de legisladores por los riesgos que sus redes sociales pueden suponer para los usuarios jóvenes. En agosto, Meta aceptó pagar hasta 18.000 millones de dólares para cerrar una demanda sobre protección infantil presentada por 29 estados de EE. UU.

Nuestra opinión

La herramienta contra la señalización refleja un cambio real en cómo debe funcionar la moderación de contenidos. Los abusadores ya no necesitan publicar material ilegal en una plataforma. Les basta con que la plataforma les envíe tráfico. Eso significa que los sistemas de seguridad tienen que seguir los enlaces y evaluar los destinos, algo más difícil y más caro que analizar imágenes o texto. Que Meta recurra a un LLM para esto indica que lo ve como una tarea que requiere contexto y razonamiento, no solo comparar con contenido ya conocido.

El agente de red teaming también merece atención. Usar IA para poner a prueba las defensas de la IA es cada vez más habitual en el sector, y la protección infantil en los productos de IA está bajo un escrutinio creciente, como demostró una evaluación reciente de ChatGPT para adolescentes. La cifra del 97 % de Meta mide lo que detectó, no lo que se le escapó. Habrá que ver si la compañía publica datos específicos sobre la señalización y si investigadores externos pueden comprobar hasta qué punto funcionan estas herramientas.