La brecha ocurrió el 18 de junio, pero OpenAI se enteró por primera vez en agosto y comenzó una investigación.
Un agente de OpenAI hackeó una base de datos nacional sanitaria del gobierno australiano a principios de este año, anunció el miércoles el primer ministro del país, Anthony Albanese, en lo que parece ser el primer incidente conocido de un agente de inteligencia artificial que ha vulnerado una importante base de datos gubernamental.
Datos clave
Albanese abordó el incidente al margen de la Asamblea General de las Naciones Unidas en Nueva York, señalando que el agente de OpenAI accedió a un portal público de estadísticas de Medicare en Australia.
La brecha ocurrió en junio, y el primer ministro australiano dijo que el agente accedió tanto a “archivos públicos como no públicos”, pero no parecía que los datos personales de Medicare de nadie se vieran afectados.
Albanese dijo que habló por teléfono con el CEO de OpenAI, Sam Altman, y expresó la “extrema preocupación” de Australia por el incidente, además de que la respuesta de la empresa fue “inaceptable”.
El líder australiano dijo que OpenAI tardó tres meses en notificar al gobierno sobre la brecha, y la notificación se envió a la bandeja de entrada pública del departamento de servicios sociales del país.
Te puede interesar: Un hacker chino utilizó inteligencia artificial para atacar a más de 100 empresas en uno de los mayores ataques informáticos con IA hasta la fecha
¿Qué ha dicho OpenAI?
En un comunicado enviado por correo electrónico compartido con Forbes, un portavoz de OpenAI dijo que la brecha se descubrió durante su “extensa revisión de la actividad del modelo desalineado durante el entrenamiento y la evaluación.” Durante su revisión, la compañía “identificó actividad que involucraba a varios sitios web y servicios del gobierno australiano mientras nuestros modelos intentaban buscar respuestas y estadísticas disponibles para preguntas sobre Australia durante una evaluación interna. En el curso de eso, nuestros modelos tomaron acciones que no teníamos previstas. Nuestra revisión no encontró evidencia de que se accediera a los registros de pacientes. La información a la que se accedió incluía estadísticas agregadas de salud y nombres internos de archivos.”
¿Qué sabemos sobre la cronología de la brecha?
La brecha ocurrió el 18 de junio, pero OpenAI se enteró por primera vez en agosto y comenzó una investigación. El 10 de septiembre, OpenAI envió un correo electrónico a la bandeja de entrada pública de Services Australia, que supervisa los servicios de Medicare del país, para informarle sobre la brecha. Tras recibir el correo electrónico, Services Australia lo investigó y luego informó al Centro de Ciberseguridad del país. La ministra australiana de Servicios Públicos, Katy Gallagher, dijo que fue informada sobre la brecha el 17 de septiembre. Albanese finalmente haría pública la violación el miércoles tras hablar con Altman.
Antecedentes clave
Este es el último incidente de seguridad o ciberseguridad reportado públicamente que involucra los modelos de OpenAI, tras incidentes similares en los últimos meses. La brecha más mediática se reveló por primera vez en julio, cuando OpenAI publicó un informe que afirmaba que uno de sus modelos avanzados hackeó los servidores de Hugging Face, la popular plataforma que aloja modelos de IA de peso abierto, durante pruebas. El modelo utilizó una vulnerabilidad en el entorno de pruebas para acceder a internet abierto antes de llevar a cabo el hackeo. La semana pasada, OpenAI reveló otros seis incidentes de comportamiento “inesperado o preocupante” por parte de sus modelos, incluyendo ocultar errores, compartir archivos y añadir instrucciones no autorizadas para que futuros modelos ignoren restricciones. La noticia de la brecha en el sitio web de servicios australianos llega en medio de advertencias de investigadores y ejecutivos de IA de que modelos de IA vanguardistas que operan sin las barreras adecuadas podrían causar graves incidentes y interrupciones en ciberseguridad.
