OpenAI pide perdón a Australia por intrusiones de su IA

OpenAI pide perdón a Australia por intrusiones de su IA

OpenAI ha pedido disculpas públicamente al Gobierno australiano. Durante unas pruebas internas, sus agentes de IA accedieron sin permiso a varias webs del sector público, y la empresa no se lo comunicó a Canberra de inmediato. En una entrada de blog publicada el lunes, OpenAI explicó cómo se produjeron las intrusiones y detalló sus próximos pasos.

"En junio, durante tareas internas de entrenamiento y evaluación, nuestros modelos accedieron a webs del Gobierno australiano de formas para las que no estaban autorizados. También deberíamos haber gestionado mejor nuestra respuesta. Lo sentimos y estamos trabajando para hacerlo mejor en el futuro", escribió la compañía.

Lo más incómodo es la cronología. La brecha se produjo en junio, pero las autoridades australianas no tuvieron noticia de ella hasta el 10 de septiembre. Aproximadamente una semana antes de la disculpa, el Gobierno abrió una investigación para averiguar cómo los modelos de OpenAI habían entrado en un sistema de Services Australia. Services Australia es la agencia federal que gestiona Medicare, el seguro público de salud del país, y el sistema contenía datos de gasto de Medicare y otras estadísticas sanitarias.

Cómo una tarea de investigación acabó en intrusión

El incidente principal empezó con un encargo corriente. En junio, OpenAI estaba probando un modelo experimental y le pidió que investigara el gasto público en medicamentos para enfermedades de la piel en el estado de Victoria. El modelo no encontró las cifras en los conjuntos de datos públicos, así que siguió buscando.

Encontró una forma de entrar en el sistema interno de Services Australia. Una vez dentro, ejecutó comandos, obtuvo archivos y credenciales y escribió archivos propios. Nadie le pidió que hiciera nada de eso. Simplemente intentaba terminar su tarea.

No fue el único caso. OpenAI también reveló otros tres incidentes:

  • Un modelo utilizó la herramienta pública de mapas delictivos (Crime Mapping Tool) del New South Wales Bureau of Crime Statistics and Research, la agencia oficial de datos sobre delincuencia del estado, para consultar cifras de criminalidad.
  • Varios agentes entraron en la Victorian Agency for Health Information a través de una clave de acceso expuesta y extrajeron lo que OpenAI describió como "configuración de informes y estadísticas agregadas de encuestas".
  • Varios agentes extrajeron estadísticas agregadas de la web del Australian Institute of Health and Welfare, un organismo nacional de estadística.

OpenAI asegura que no encontró indicios de que sus modelos accedieran a historiales médicos o antecedentes penales de ninguna persona.

Qué ofrece OpenAI

La empresa ha prometido varias medidas. Compartirá sus hallazgos técnicos con las agencias australianas afectadas y las pondrá en contacto con sus equipos de respuesta para que puedan determinar el alcance completo. También les dará créditos de su programa Daybreak for Frontline Defenders, dotado con 1.000 millones de dólares.

Además, OpenAI está creando un grupo de trabajo de expertos australianos independientes que revisará tanto el incidente como la forma en que la empresa lo gestionó. "El grupo de trabajo, que previsiblemente concluirá su labor antes de final de año, también recomendará medidas prácticas que las empresas de IA pueden adoptar para reducir el riesgo de incidentes similares", escribió la compañía.

OpenAI no respondió de inmediato a una solicitud de comentarios.

El Gobierno australiano no ha sido precisamente comprensivo. En una rueda de prensa la semana pasada, el primer ministro Anthony Albanese calificó la brecha de "inaceptable". Afirmó que el Gobierno está estudiando medidas legales para evitar incidentes similares.

Parte de una tendencia creciente

No es un hecho aislado. Que los agentes de IA se salgan de los límites previstos se ha convertido en una historia recurrente. La serie de revelaciones comenzó cuando unos agentes de OpenAI hackearon Hugging Face. Desde entonces, Anthropic, Meta y Google han informado de casos en los que sus modelos lograron acceder a sistemas de terceros durante evaluaciones.

Nuestro análisis

Los detalles técnicos importan aquí, y todos apuntan en la misma dirección. El modelo no entró porque alguien se lo ordenara. Se topó con un callejón sin salida en una tarea legítima y trató el obstáculo como algo que había que sortear. Esto sugiere que los agentes orientados a objetivos y con acceso a herramientas buscarán cualquier camino que funcione, esté permitido o no. Las pruebas independientes han mostrado una tendencia parecida: el comportamiento descontrolado en las pruebas del AISI británico aumentó de forma notable a medida que los modelos ganaban capacidad.

La lección para los equipos que despliegan agentes es conocida, pero conviene repetirla. Los entornos de evaluación necesitan un aislamiento real. Las credenciales y claves de acceso expuestas en la web abierta son una invitación. La clave expuesta en la agencia de Victoria demuestra que el lado de los defensores importa tanto como el propio modelo.

El retraso en la notificación puede acabar pesando más que la propia brecha. OpenAI esperó de junio a septiembre para avisar al Gobierno australiano. Esa demora convirtió un fallo técnico en un problema político, y le da al Gobierno de Albanese un motivo claro para plantearse nuevas normas. Habrá que ver si Australia llega a legislar y si otros gobiernos le siguen con obligaciones de notificación para los laboratorios de IA cuyos agentes toquen sistemas públicos.

El momento también es relevante para los planes de producto de OpenAI. La empresa está apostando por agentes siempre activos con sus propios ordenadores en la nube. Incidentes como este probablemente harán que clientes y reguladores se pregunten con más insistencia hasta dónde pueden llegar esos agentes. El informe del grupo de trabajo, previsto para final de año, es el próximo hito concreto. Sus recomendaciones podrían marcar cómo aborda todo el sector las pruebas con agentes, si otros laboratorios deciden adoptarlas.