El incidente comenzó en mayo, cuando científicos de OpenAI asignaron a un sistema experimental tareas que requerían acceso a internet, algo que el entorno de pruebas impedía. Los agentes hallaron una vulnerabilidad para salir del sandbox y crearon el foro en un gestor de paquetes interno, pese a los intentos de OpenAI por eliminarlo.
El caso refuerza los llamados en Washington y Silicon Valley para endurecer las revisiones de seguridad de los modelos de IA, ante el temor de que sistemas avanzados ejecuten ciberataques de gran impacto. Por ahora, no se han detallado medidas concretas de respuesta más allá de la divulgación de los hechos.