Le 6 octobre 2026, Tibo Sottiaux, d’OpenAI, a annoncé qu’Auto-review de Codex était gratuite pour les personnes connectées à un compte ChatGPT et ne décomptait pas d’usage de leur forfait. Cette annonce concerne le coût d’utilisation de la fonction, déjà lancée fin avril 2026.

Ce qu’Auto-review change à la frontière du sandbox

Un sandbox — ou bac à sable — est un environnement isolé qui limite les accès d’un agent, notamment aux fichiers et au réseau. Auto-review ne supprime pas ces limites : elle confie à un agent réviseur distinct l’examen de certaines demandes nécessitant une approbation pour franchir une frontière du sandbox. Le réviseur rend une décision accompagnée d’une explication ; l’agent principal conserve ses permissions et ses restrictions habituelles.

Si la demande est refusée, l’agent principal reçoit le motif et doit chercher une solution sensiblement plus sûre ou s’arrêter pour demander l’intervention de l’utilisateur.

Quelles demandes sont examinées ?

Auto-review concerne les demandes qui exigeraient autrement une approbation interactive. Cela comprend notamment les commandes shell ou exec qui dépassent les autorisations en place, les requêtes réseau bloquées, les modifications hors des répertoires autorisés et certains appels à des outils MCP ou à des applications.

Les actions déjà autorisées dans le sandbox ne passent pas par le réviseur. Les approbations liées aux applications de Computer Use sont, elles, toujours présentées directement à l’utilisateur.

Ce qu’OpenAI a mesuré en avril 2026

Dans son évaluation interne publiée le 30 avril 2026, OpenAI rapportait un taux d’approbation de 99,1 % pour le trafic interne d’actions nécessitant une escalade hors du sandbox. L’évaluation indiquait aussi un taux d’approbation effectif de 99,93 % sur l’ensemble des actions, y compris celles qui restaient dans le sandbox.

Ces chiffres portent sur l’évaluation interne d’avril. OpenAI précise qu’Auto-review n’offre pas de garantie de sécurité déterministe et que les résultats dépendent notamment de l’environnement et de la configuration du sandbox.

Limites de sécurité et activation

Un réviseur peut se tromper, en particulier dans un contexte inhabituel ou adversarial, et Auto-review n’examine pas toutes les actions effectuées à l’intérieur du sandbox. OpenAI recommande de l’associer à une conception solide du sandbox et à une surveillance adaptée.

Pour activer la fonction, Tibo Sottiaux a indiqué le chemin Settings > Permissions > Auto-review. Le mode de permission de bureau est nommé « Approve for me ». Auto-review nécessite des approbations interactives : la configuration documentée comprend approval_policy = "on-request" et approvals_reviewer = "auto_review". Avec approval_policy = "never", aucune demande d’approbation n’est disponible pour le réviseur.