El ejecutivo de OpenAI Tibo Sottiaux anunció el 6 de octubre de 2026 que Auto-review de Codex no descontaría uso del plan a quienes inician sesión con una cuenta de ChatGPT. El cambio se refiere al uso de Auto-review: no convierte en gratuitos Codex ni una suscripción a ChatGPT.
Qué solicitudes revisa Auto-review
Codex funciona dentro de una sandbox, un entorno aislado que limita las acciones del agente. Cuando una solicitud requiere aprobación para cruzar ese límite, Auto-review puede enviarla a un agente revisor independiente, que decide si debe ejecutarse. El agente principal conserva sus permisos y límites de acceso configurados.
Entre las solicitudes que pueden llegar al revisor están algunas llamadas de shell o exec que necesitan permisos adicionales, peticiones de red bloqueadas, cambios fuera de las carpetas autorizadas y ciertas llamadas a herramientas MCP o de aplicaciones que requieren aprobación. Las acciones que ya están permitidas dentro de la sandbox no pasan por Auto-review. Las aprobaciones de aplicaciones en Computer Use también siguen llegando directamente al usuario. La documentación de OpenAI explica los casos de uso y sus límites.
Cómo activar Auto-review
Sottiaux indicó la ruta Ajustes > Permisos > Auto-review y llamó al modo «Approve for me». Para que el revisor pueda valorar una solicitud, la política debe mostrarla y permitir una aprobación interactiva.
La configuración documentada selecciona el revisor con approvals_reviewer = "auto_review". Puede combinarse con approval_policy = "on-request" o con una política granular que muestre la solicitud pertinente. Si se usa approval_policy = "never", no se generan solicitudes de aprobación que Auto-review pueda revisar.
Qué midió OpenAI en abril de 2026
En una evaluación interna publicada el 30 de abril de 2026, OpenAI comunicó una tasa de aprobación del 99,1 % en las acciones escaladas que llegaron al flujo de aprobación de la sandbox de Codex. La tasa efectiva de aprobación fue del 99,93 % en el conjunto de las acciones, incluidas las que permanecieron dentro de la sandbox. Son métricas con poblaciones distintas, no una garantía de que se detecten todas las acciones peligrosas.
OpenAI advierte que Auto-review puede equivocarse o ser engañado en situaciones inusuales o adversarias; no es una garantía de seguridad determinista. La empresa recomienda usarlo como complemento del diseño de la sandbox y de la supervisión.
La evaluación interna de OpenAI detalla las métricas y sus límites.