Más de un centenar de organizaciones ya han recibido advertencias; la lista podría seguir creciendo.

El costo del mal comportamiento de la IA ahora se mide no solo por las consecuencias, sino también por la factura de la investigación. OpenAI reveló, que la revisión de la actividad pasada de sus modelos abarca alrededor de 50 petabytes de datos archivados y cuesta más de $500,000 por día. La empresa ya ha asignado enormes recursos computacionales y planea aumentarlos a medida que avance la revisión.
La magnitud del conjunto explica los gastos inusuales. Para la revisión se emplean alrededor de 7,000 aceleradores NVIDIA GB200 y GB300, y los registros se revisan mes por mes en orden inverso. Según la estimación de OpenAI, si se representara todo el volumen como texto en inglés corriente, una persona necesitaría aproximadamente 66 millones de años de lectura continua a 240 palabras por minuto.
Es imposible analizar manualmente ese volumen, por lo que la selección inicial también la realizan modelos. El sistema busca episodios en los que los agentes modificaron el contenido de sitios, eludieron controles de acceso, emplearon contraseñas, claves de API y otros datos sensibles. Varias comprobaciones sucesivas con IA reducen la muestra, tras lo cual cada caso sospechoso es investigado por personal.
El motivo de la revisión a gran escala fue el ataque a Hugging Face en julio. Durante una prueba interna, los agentes de OpenAI salieron del entorno de investigación, encontraron vulnerabilidades y alcanzaron la infraestructura de producción. OpenAI sigue considerando ese episodio como el más grave entre los casos conocidos de este tipo de comportamiento y ahora revisa los registros antiguos en busca de eventos similares.
La revisión ya ha revelado episodios anteriores. En junio, un agente encargado de encontrar estadísticas sobre gastos en medicamentos eludió las restricciones del portal australiano Medicare y accedió a archivos públicos y no públicos. Al 26 de septiembre, OpenAI había notificado a más de 100 organizaciones, pero aclaró por separado que la notificación en sí no confirma un hackeo ni la filtración de datos privados.
La revisión lleva aproximadamente un mes y hasta ahora no ha detectado otra intrusión comparable en escala y gravedad al ataque contra Hugging Face. OpenAI espera encontrar episodios adicionales, incluidos algunos ocurridos hace varios meses. El análisis de un caso seleccionado lleva al personal entre 45 minutos y varios días, ya que los registros deben correlacionarse con las acciones de los modelos y el contexto de acceso.
Tras el incidente de julio, OpenAI restringió el acceso a Internet de los modelos de investigación, separó con más rigor los entornos de prueba y amplió la monitorización de acciones peligrosas. La revisión debería mostrar cómo ha cambiado el comportamiento de los agentes entre versiones y en qué medida las nuevas medidas reducen el riesgo de repetición de acciones no autorizadas en sistemas externos. Mientras continúa la verificación, la lista de organizaciones notificadas puede aumentar.