C’est une affaire dont OpenAI a du mal à s’extirper.
Le 1er octobre, on apprenait que l’entreprise américaine se séparait de trois chercheurs travaillant sur la sécurité de ses modèles : Jasmine Wang, Tomek Korbak et Mikita Balesni. Le Wall Street Journal rapportait alors qu’ils étaient soupçonnés d’avoir partagé des informations confidentielles avec une organisation spécialisée dans la sûreté de l’IA, et l’entreprise avait confirmé les départs en évoquant des violations de ses règles sur l’accès et le traitement d’informations sensibles.
Mais voilà, depuis, les trois chercheurs ont pris la parole publiquement pour contester leur renvoi, et le 9 octobre, OpenAI s’est senti obligée de répondre.
Une lettre ouverte pour se défendre
Revenons dans un premier temps sur la version des chercheurs. Le 8 octobre, Jasmine Wang, Tomek Korbak et Mikita Balesni ont adressé une lettre ouverte aux instances de sécurité d’OpenAI. Partant du constat que « l’IA n’est pas une technologie normale, et OpenAI n’est pas une entreprise normale », ils défendent l’idée que les chercheurs en sécurité doivent pouvoir travailler étroitement avec des experts extérieurs sans crainte.


Les chercheurs contestent notamment avoir traité des informations sensibles en dehors des procédures de l’entreprise et s’inquiètent surtout de l’effet de leur renvoi sur ceux qui restent.
Jasmine Wang a ajouté sur X qu’on lui reprochait d’avoir consulté la messagerie d’un dirigeant, un accès qui lui avait été délégué, dit-elle, pour du recrutement et dont elle avait demandé en vain la suppression. Elle affirme avoir ouvert un mail sensible par erreur et avoir prévenu le dirigeant concerné dans les minutes qui ont suivi. Mikita Balesni estime de son côté avoir été renvoyé pour avoir fait passer la sécurité avant les intérêts immédiats de l’entreprise.
OpenAI maintient sa décision
La réponse d’OpenAI est donc arrivée le lendemain, à travers une publication sur X signée par ses responsables de la recherche.
Ils y affirment que l’enquête interne a mis au jour un abus de confiance « significatif », plus grave que ce que les chercheurs reconnaissent dans leur lettre, sans en dire davantage au nom de la confidentialité. Surtout, la note répète à deux reprises que ces licenciements n’ont rien à voir avec le fait d’avoir alerté sur des risques.
Le contexte de ces départs touche pourtant directement au travail de sécurité mené par OpenAI. Tomek Korbak servait d’interlocuteur à METR et Redwood Research, deux organisations extérieures qui enquêtaient sur l’incident Hugging Face de juillet dernier. Mikita Balesni travaillait quant à lui sur la lisibilité du raisonnement des modèles, un chantier qui exige selon la lettre de nombreux échanges avec l’extérieur.
Ce dernier sujet est particulièrement sensible pour OpenAI. L’entreprise communique régulièrement dessus, notamment par la voix de son directeur scientifique, mais le débat lui a en partie échappé.
Début septembre, The Information révélait, avant sa sortie, que le modèle Astra d’OpenAI utilisait une technique rendant ce raisonnement plus difficile à lire, ce qui avait inquiété une partie du milieu de la sécurité de l’IA. Les trois chercheurs affirment d’ailleurs ne pas être à l’origine de cette fuite.
Dans leur lettre, ils demandent à OpenAI d’accueillir des évaluateurs externes et de préserver cette lisibilité du raisonnement. L’entreprise leur donne raison sur ces deux points et assure que des contrats avec des évaluateurs seront annoncés dans les prochaines semaines.
+ rapide, + pratique, + exclusif
Zéro publicité, fonctions avancées de lecture, articles résumés par l'I.A, contenus exclusifs et plus encore.
Découvrez les nombreux avantages de Numerama+.
Vous avez lu 0 articles sur Numerama ce mois-ci
Tout le monde n'a pas les moyens de payer pour l'information.
C'est pourquoi nous maintenons notre journalisme ouvert à tous.
Mais si vous le pouvez,
voici trois bonnes raisons de soutenir notre travail :
- 1 Numerama+ contribue à offrir une expérience gratuite à tous les lecteurs de Numerama.
- 2 Vous profiterez d'une lecture sans publicité, de nombreuses fonctions avancées de lecture et des contenus exclusifs.
- 3 Aider Numerama dans sa mission : comprendre le présent pour anticiper l'avenir.
Si vous croyez en un web gratuit et à une information de qualité accessible au plus grand nombre, rejoignez Numerama+.
Toute l'actu tech en un clin d'œil
Ajoutez Numerama à votre écran d'accueil et restez connectés au futur !
Un édito exclusif, un guide, une reco de lecture et l’agenda de la rédaction : c’est ce que vous trouverez tous les jeudis dans ToujoursPlus, la newsletter tech écrite par Julien Cadot. Inscrivez-vous gratuitement ici !

