Qué ha cambiado

Meta publicó el 7 de octubre un conjunto de medidas de protección infantil, y la que importa técnicamente es un cambio en qué mira una revisión de anuncios.

Hasta ahora la pregunta que responde una revisión automática es si el anuncio en sí incumple una norma. Meta dice que añade una evaluación basada en el destino: los sistemas valoran ahora adónde envía el anuncio a una persona, de modo que un destino no conforme puede bloquearse y actuarse contra las cuentas que hay detrás.

Junto a ello la compañía ha puesto un modelo de lenguaje sobre lo que llama señalización: anuncios de apariencia del todo corriente pero de los que se sospecha con fuerza que dirigen a los usuarios hacia contenido ilegal o actividad dañina en otro lugar de la red. Meta dice que los actores maliciosos adoptaron la táctica justamente para esquivar la revisión centrada solo en el contenido.

Las cifras que dio Meta

Para la primera mitad de 2026, Meta dice que actuó sobre 33,2 millones de contenidos de explotación sexual infantil en Facebook e Instagram, y que más del 97% se detectó y trató antes de que nadie lo denunciara. Para la India da 5,3 millones de contenidos con más del 98% detectado de forma proactiva.

Una persona trabaja ante dos monitores en una oficina
La compañía informa de actuaciones sobre 33,2 millones de contenidos en seis meses. Imagen ilustrativa. Kampus Production · pexels · Pexels License

Son recuentos de actuaciones, no estimaciones de prevalencia. Una cifra al alza puede significar más abuso o mejor detección, y la publicación no separa ambas cosas. Meta no da cifra alguna de actuaciones relacionadas con anuncios, que es justo de lo que tratan las nuevas medidas.

El resto del paquete

Meta describe también barridos adicionales con IA dirigidos a material que los sistemas anteriores pasaron por alto, mejor detección de usuarios expulsados que vuelven con cuentas nuevas, y un agente de IA de equipo rojo que sondea las propias defensas de Meta para, en palabras de la compañía, identificar nuevas tácticas adversarias antes de que se extiendan.

El agente de equipo rojo es lo interesante. Un adversario automatizado que encuentra los huecos de un clasificador antes que un atacante es la misma técnica que los equipos de seguridad aplican al código, apuntada aquí a una pila de moderación. Meta no publica ningún resultado suyo.

Una mano sostiene un móvil que muestra una cuadrícula de aplicaciones
Un agente de equipo rojo sondea las propias defensas de Meta, según la empresa. Imagen ilustrativa. Brian Ramirez · pexels · Pexels License

El contexto en que llega

Meta lleva tiempo bajo presión legal y regulatoria en materia de protección infantil. En agosto acordó pagar hasta 18.000 millones de dólares para zanjar una demanda de 29 estados de EE UU por daños a menores. A principios de año añadió controles parentales a Meta AI, cuentas de WhatsApp vinculadas a padres para preadolescentes y avisos en Instagram cuando un adolescente busca contenido de suicidio o autolesión.

La publicación aparece en la sala de prensa de Meta en la India, y menciona un compromiso de septiembre para denunciar casos de seguridad infantil directamente al portal nacional de ciberdelincuencia del país.

Qué vigilar

Si Meta publica alguna medida de con qué frecuencia se activa la comprobación de destino, y qué proporción de destinos marcados resultan infractores. Un clasificador apuntado a los enlaces de destino es también un clasificador que puede equivocarse con la página de aterrizaje de un anunciante legítimo, y ninguna de las dos tasas de error tiene todavía un número al lado.