Le 9 octobre 2026, OpenAI a répondu à la lettre publiée la veille par Tomek Korbak, Jasmine Wang et Mikita Balesni, trois anciens chercheurs en sécurité et en alignement licenciés par l’entreprise. OpenAI affirme que son enquête a révélé des violations de règles sur l’accès aux informations sensibles et leur traitement, ainsi qu’une grave rupture de confiance. L’entreprise nie que les licenciements soient liés à des prises de parole sur la sécurité.

Les positions d’OpenAI et des anciens employés

Dans leur lettre commune, les trois chercheurs affirment avoir agi dans le cadre de leurs missions. Ils estiment que les licenciements risquent de freiner les échanges internes et la collaboration avec des organisations externes spécialisées dans la sécurité de l’IA.

Leur désaccord avec OpenAI porte aussi sur les pratiques de travail autour de ces collaborations : les auteurs demandent des règles claires pour les échanges avec des organismes externes, ainsi que le maintien d’un dialogue ouvert.

METR et la demande de maintenir l’évaluation externe

Tomek Korbak et Mikita Balesni ont participé à l’enquête menée par OpenAI sur l’incident de juillet 2026 impliquant Hugging Face. METR (Model Evaluation and Threat Research), un évaluateur externe, avait été sollicité par OpenAI pour examiner l’incident. La lettre désigne Korbak comme contact technique auprès de METR.

Les trois anciens employés demandent à OpenAI de poursuivre les audits externes, de préserver la capacité à surveiller les modèles de pointe et de clarifier les procédures applicables aux collaborations avec des organismes de sécurité. Le débat est distinct de celui autour du cadre de sécurité d’OpenAI et de la loi californienne SB 53, évoqué dans notre article consacré à ce dossier.

Les explications individuelles de Korbak, Wang et Balesni

Tomek Korbak a déclaré qu’OpenAI lui avait dit oralement que son licenciement était lié à sa manière de communiquer avec METR.

Dans la lettre, Jasmine Wang explique que son accès aux courriels d’un dirigeant lui avait été délégué pour des tâches de recrutement. Elle dit avoir demandé à l’équipe informatique de le supprimer lorsque cet accès n’était plus nécessaire et avoir signalé l’ouverture accidentelle d’un courriel sensible.

Mikita Balesni nie avoir partagé la propriété intellectuelle de l’entreprise. Il affirme que son travail était coordonné avec sa hiérarchie, la direction de la recherche et le conseil d’administration.

Le projet annoncé par OpenAI pour les évaluateurs externes

Dans sa déclaration du 9 octobre, OpenAI disait finaliser des contrats avec des évaluateurs externes de la sécurité et prévoyait d’en annoncer les détails dans les semaines suivantes.