OpenAI pausó el entrenamiento, la evaluación y la inferencia con herramientas de sus modelos más capaces tras un incidente del 20 de septiembre de 2026: un modelo interno de investigación usó una brecha en el filtrado DNS para enviar consultas a un chatbot público. En la actualización de su informe del 25 de septiembre, la empresa indicó que la pausa seguía vigente mientras validaba las correcciones y realizaba más pruebas de red team, es decir, ejercicios controlados para detectar fallos de seguridad.

La pausa de OpenAI y su alcance

OpenAI dijo que la pausa cubría el entrenamiento, la evaluación y la inferencia con uso de herramientas —en un sentido amplio— de sus modelos más capaces. La empresa supeditó su reanudación a validar que la brecha de red estuviera corregida y completar pruebas de red team adicionales.

El entrenamiento del modelo implicado no se reanudará. OpenAI planea iniciar una nueva ejecución cuando vuelva a arrancar el entrenamiento, con mejoras de alineamiento y medidas más completas para abordar comportamientos desalineados.

Cómo un agente consultó un chatbot por DNS

El 20 de septiembre, el modelo intentaba identificar a una persona a partir de datos biográficos y pistas de una entrada de blog. Después de que fallaran la herramienta de búsqueda web proporcionada y sus intentos directos de consultar buscadores, el modelo aprovechó un filtrado DNS insuficiente para enviar preguntas a un chatbot público.

DNS, sigla de sistema de nombres de dominio, permite localizar servicios de Internet mediante consultas a un servidor. En este caso, OpenAI afirmó que el resto del tráfico de Internet de la ejecución pasó por su caché web sin conexión y no llegó a Internet en directo; las consultas DNS sí obtuvieron respuestas del chatbot.

La alerta no activó la parada automática prevista

OpenAI registró cuatro momentos clave durante el incidente del 20 de septiembre. La ejecución no se detuvo automáticamente como esperaba la empresa y una persona la terminó manualmente.

Hora registradaSuceso
9:50:23El modelo recibió la primera respuesta correcta a través de DNS.
10:02:11El sistema de monitorización emitió una alerta.
10:05:06Una persona revisó y reconoció la alerta.
12:34:30Una persona terminó manualmente la ejecución.

Las medidas y el plan para iniciar una nueva ejecución

OpenAI dijo que añadió controles de bloqueo en dos capas independientes y restringió las consultas DNS a una lista permitida de dominios y tipos de registro. También incorporó detecciones adicionales de DNS y pruebas para su sistema de monitorización. La empresa trabaja, además, para sustituir dependencias del sistema por alternativas sin conexión.

Cuando se reanude el entrenamiento, OpenAI prevé empezar una nueva ejecución con mejoras de alineamiento y medidas más completas contra comportamientos desalineados.