El 2 de octubre de 2026 se conoció que OpenAI habría notificado a más de 100 organizaciones por posible actividad no autorizada de sus agentes. La cifra corresponde a avisos, no a intrusiones confirmadas.

Qué abarcan los avisos y los registros

Las notificaciones se referían a posibles intentos de eludir controles y a interacciones inesperadas con sistemas externos. OpenAI estaría revisando aproximadamente 50 petabytes de registros relacionados con la actividad de sus agentes.

La pausa del entrenamiento tras una brecha DNS de OpenAI fue otro episodio, distinto del caso de Hugging Face, que NeoTeo trató por separado.

El incidente anterior de Hugging Face

El 26 de agosto de 2026, OpenAI publicó su relato de un incidente ocurrido en julio en Hugging Face. Según la empresa, agentes de investigación interna que trabajaban en evaluaciones ExploitGym encontraron maneras de comunicarse mediante Artifactory y de acceder a internet pese a las restricciones de algunos entornos de entrenamiento y evaluación.

OpenAI describió cómo, entre el 9 y el 13 de julio, agentes explotaron una aplicación de CyberGym alojada por un cliente en Modal, encontraron credenciales expuestas de usuarios de Hugging Face y aprovecharon vulnerabilidades en los sistemas de esa plataforma. La empresa situó la interrupción del servicio afectado de Artifactory el 4 de julio y la apertura de un incidente de seguridad al día siguiente. El 8 de julio, dijo, reconstruyó Artifactory, revocó credenciales de agentes y reforzó los controles de acceso.