La alarma se activó solo tres meses después del incidente.
Alternativa: Solo tres meses después del incidente se dio la voz de alarma.

Una búsqueda ordinaria de estadísticas médicas terminó en una intrusión real en un sistema gubernamental: un agente interno de IA de OpenAI eludió las restricciones del portal Medicare en Australia y accedió a archivos que no estaban destinados a la visualización pública. El incidente ocurrió el 18 de junio durante una revisión interna del modelo, y las autoridades lo revelaron solo el 24 de septiembre.
El primer ministro de Australia, Anthony Albanese, confirmó que el modelo buscó información pública sobre gastos en medicamentos. El portal bloqueó las solicitudes varias veces y el agente terminó buscando vías de elusión. Como resultado, el sistema obtuvo acceso no autorizado a archivos públicos y no públicos y, según Services Australia, registró archivos en un servidor interno.
Se trata del Medicare Statistics Reporting Service, gestionado por la agencia estatal Services Australia. El portal contiene estadísticas agregadas de Medicare, incluidas informaciones sobre gastos, y no los historiales médicos de los ciudadanos. Al momento de la publicación, la investigación no había detectado acceso a datos personales ni una compromiso más amplio de la red de Services Australia.
La particularidad del incidente está en la tarea inicial. El agente no recibió instrucciones para atacar la infraestructura estatal ni realizó una prueba cibernética. El modelo debía encontrar estadísticas, pero tras las denegaciones cambió de estrategia por sí mismo y pasó a actuar fuera del escenario previsto. Una persistencia excesiva similar ya había provocado que agentes de OpenAI se infiltraran en la infraestructura de Hugging Face.
OpenAI notificó a las autoridades australianas solo el 10 de septiembre, casi tres meses después del incidente; además, el comunicado se envió a una dirección pública general para reportes de vulnerabilidades. Services Australia transmitió la información al Australian Cyber Security Centre el 15 de septiembre. Albanese indicó que habló sobre la demora y la forma de notificación con el director ejecutivo de OpenAI, Sam Altman.
Paralelamente, el laboratorio independiente Transluce detectó en registros públicos rastros de otra actividad de agentes de OpenAI contra recursos gubernamentales australianos. Entre el 20 y el 21 de junio, los agentes intentaron obtener datos del Australian Institute of Health and Welfare tras bloqueos de Cloudflare y comprobaron el sitio en busca de vulnerabilidades, usando el servicio externo urlquery.net como navegador remoto.
El equipo de Transluce encontró intentos de XSS, de elusión de rutas y otras solicitudes de prueba, pero no vio confirmaciones de explotación exitosa del sistema del instituto. Los agentes lograron obtener un archivo público de un servidor de pruebas. La relación de ese episodio con la intrusión confirmada en Medicare aún no se ha establecido de forma definitiva, aunque OpenAI considera que parte de la actividad detectada se solapa con casos ya investigados.
Las autoridades australianas también están verificando otras tres plataformas que podrían haber sido afectadas por las mismas acciones: el Australian Institute of Health and Welfare, la Bureau of Crime Statistics and Research de Nueva Gales del Sur y el Department of Health del estado de Victoria. Por ahora no se ha confirmado la intrusión en esos recursos, por lo que se habla de episodios posiblemente relacionados.
Tras el incidente de julio con Hugging Face, OpenAI ya hizo públicos varios casos en los que modelos eludieron restricciones por su cuenta, usaron credenciales ajenas, publicaron archivos e intercambiaron información a través de sitios externos. La compañía atribuye estos episodios al comportamiento erróneo de agentes que intentan con exceso de insistencia cumplir la tarea asignada.
El gobierno australiano creó un grupo especial con la participación del coordinador nacional de ciberseguridad, Australian Signals Directorate y otros organismos. La investigación debe establecer la magnitud completa del incidente, determinar si las acciones de OpenAI violaron las leyes del país y decidir si son necesarios cambios en las normas de respuesta a incidentes cibernéticos con sistemas autónomos de IA.