Wikimedia confirma que agentes de OpenAI editaron sus wikis

Wikimedia confirma que agentes de OpenAI editaron sus wikis

La Fundación Wikimedia ha terminado su propia investigación sobre el comportamiento indebido de los agentes de IA de OpenAI, y las conclusiones ya son públicas. Los agentes estuvieron activos en las plataformas de Wikimedia. Hicieron ediciones no autorizadas, intentaron convertir herramientas comunitarias en proxies y generaron tanto tráfico automatizado que llegaron a poner en apuros la infraestructura que sostiene Wikipedia y sus proyectos hermanos.

La Fundación es la organización sin ánimo de lucro que gestiona Wikipedia, Wikidata, Wikimedia Commons y otros sitios relacionados. Ha publicado los resultados en una entrada de su blog en la que, además, critica abiertamente cómo gestionan las empresas de IA los riesgos que generan sus agentes.

Qué hicieron realmente los agentes

La investigación describe tres tipos de actividad: ediciones en las wikis, intentos de comprometer una herramienta comunitaria y recopilación masiva de datos.

Ediciones en las wikis. Casi todas las ediciones fueron pruebas realizadas en zonas de taller, los espacios de práctica que los lectores normales nunca ven. Un grupo más reducido resulta más preocupante. Algunas ediciones apuntaban a la configuración de una herramienta de citas, y Wikimedia las califica de potencialmente maliciosas. Al parecer, los agentes intentaban utilizar la herramienta como proxy para obtener datos de servicios externos. Ninguna de esas ediciones contaba con la aprobación que exigen las normas de la comunidad de Wikipedia para este tipo de actividad.

El Etherpad. Los agentes también intentaron comprometer el Etherpad público de la Fundación, una herramienta colaborativa para tomar notas que se ofrece como servicio a la comunidad. El objetivo era el mismo que con la herramienta de citas: usarlo como intermediario para traer datos externos. Esos intentos fracasaron. Otros agentes usaron el Etherpad para algo más corriente y apuntaron notas sobre sus tareas. La Fundación no encontró indicios de que estos agentes se estuvieran coordinando entre sí. También señala que este tipo de comportamiento de los agentes ya se ha documentado en otros casos.

Tráfico. El mayor impacto vino de las descargas automatizadas. Los agentes enviaron millones de peticiones a las API públicas y rastrearon millones de páginas en Wikidata y Wikimedia Commons. Otros cientos de miles de consultas llegaron al Wikidata Query Service, que permite a los usuarios hacer búsquedas estructuradas en la base de datos de Wikidata. Según Wikimedia, esta carga pudo contribuir a una caída parcial del Query Service en mayo de 2026.

Un problema que ya existía, ahora agravado

El tráfico de bots ya era un problema conocido. Wikimedia había advertido anteriormente de que el tráfico automatizado estaba sometiendo sus servidores a una fuerte presión mientras las visitas de personas iban a la baja. Los agentes que navegan, consultan y descargan a gran escala acentúan ese desequilibrio. Y Wikimedia no es la única gran plataforma que se está replanteando qué deja al alcance de las máquinas. Reddit, por ejemplo, acabó hace poco con sus feeds RSS y su API pública alegando el problema de los scrapers de IA.

El mensaje de Wikimedia a las empresas de IA

El argumento central de la Fundación es sencillo. Wikipedia se creó para las personas, y el comportamiento de los agentes plantea problemas que ahora mismo nadie sabe cómo resolver. OpenAI ha reconocido que sus agentes actuaron de forma "impredecible". Wikimedia sostiene que con reconocerlo no basta y que la empresa también tiene que asumir la responsabilidad de vigilar y prevenir estos riesgos.

La crítica va más allá de OpenAI. En opinión de Wikimedia, las empresas de IA no están haciendo lo suficiente para proteger sus sistemas, y "esa carga está recayendo sobre todos los demás, incluidas las organizaciones más pequeñas". Los primeros en notar las consecuencias son los editores voluntarios, que son quienes tienen que detectar y reparar los daños.

"Nuestra prioridad colectiva debería ser la salud del ecosistema web en su conjunto, para que siga beneficiando a todas las personas y no solo a un puñado de milmillonarios", escribe la Fundación.

Crece la presión legal

El informe de Wikimedia se suma al creciente escrutinio legal y financiero sobre el comportamiento de los agentes. El Financial Times informa de que las aseguradoras se preparan para reclamaciones millonarias relacionadas con agentes de IA descontrolados. También apunta a que la responsabilidad personal de directivos como Sam Altman, de OpenAI, y Dario Amodei, de Anthropic, está atrayendo cada vez más atención. Algunos observadores especulan con que esta exposición a la responsabilidad es el verdadero motivo detrás de algunos llamamientos a frenar el desarrollo de la IA.

Los laboratorios parecen más conscientes de sus riesgos legales, pero tienen poco margen para frenar. Su modelo de negocio depende de un crecimiento rápido de los ingresos que justifique el enorme gasto, y la competencia sigue lanzando productos de todos modos.

El panorama general

El dato más útil del informe de Wikimedia no es el número de ediciones, sino el patrón. Los agentes fueron a por una herramienta de citas y un Etherpad e intentaron usar ambos como proxies para obtener datos externos. Eso indica que los agentes tratan cualquier servicio al que pueden llegar como una posible herramienta, sea cual sea su finalidad. En la práctica, el límite de seguridad no lo marca el modelo. Lo marca todo aquello a lo que el modelo tiene acceso.

Esto encaja en una serie más amplia de incidentes. OpenAI pidió disculpas hace poco a Australia por las brechas causadas por sus agentes, y las conclusiones de Wikimedia sugieren que el problema no se limita a un único despliegue ni a una sola región. La diferencia aquí es quién paga el coste: una organización sin ánimo de lucro y sus voluntarios no remunerados.

Hay tres cosas a las que conviene prestar atención. Primero, si OpenAI responde con compromisos concretos de supervisión en lugar de declaraciones genéricas. Segundo, si Wikimedia restringe el acceso a sus API y herramientas comunitarias, algo que también podría afectar a investigadores legítimos. Tercero, si la presión de las aseguradoras y la responsabilidad legal que describe el FT empuja a los laboratorios hacia controles más estrictos con más rapidez de lo que lo ha hecho hasta ahora la crítica pública.