Open AI traverse un nouvel épisode sensible autour de la gouvernance de ses systèmes d’intelligence artificielle. L’entreprise à l’origine de ChatGPT s’est séparée de trois personnes travaillant dans ses équipes de sécurité après avoir conclu qu’elles avaient enfreint ses règles concernant l’accès et le traitement d’informations confidentielles. Une partie des données aurait été communiquée à un organisme extérieur spécialisé dans l’évaluation de l’intelligence artificielle. L’identité précise de cet organisme et la nature des informations concernées n’ont toutefois pas été rendues publiques par Open AI.
Open AI : des licenciements sur fond de fuites d’infos sensibles
L’affaire a été révélée le 1er octobre 2026 par le Wall Street Journal. Selon le quotidien américain, Open AI a licencié trois chercheurs après des accusations de comportement contraire aux règles internes, notamment pour le partage présumé d’informations confidentielles avec une organisation tierce spécialisée dans la sécurité de l’intelligence artificielle. L’entreprise a confirmé avoir mis fin à sa collaboration avec trois personnes à la suite d’une enquête interne. Elle affirme que les salariés concernés ont traité des informations sensibles en dehors des procédures prévues. OpenAI considère cette situation comme une violation de ses règles et de la relation de confiance nécessaire à ses activités de recherche. L’entreprise n’a cependant pas détaillé publiquement les documents concernés, leur niveau de confidentialité ni les circonstances précises de leur transmission. Le Wall Street Journal rapporte que les trois personnes travaillaient dans les activités de sécurité du groupe. D’autres médias ont apporté des descriptions légèrement différentes de leurs fonctions, The Register évoquant notamment deux chercheurs en sécurité et un responsable de programme.
L’épisode est d’autant plus sensible qu’Open AI cherche parallèlement à développer les évaluations indépendantes de ses modèles. Le 22 septembre, quelques jours avant la révélation des licenciements, l’entreprise avait publié ses principes concernant le recours à des évaluateurs extérieurs. OpenAI y affirme que les laboratoires développant des modèles de pointe doivent permettre à des organismes indépendants d’accéder à certaines informations relatives à l’entraînement, aux tests et au déploiement des systèmes. L’objectif affiché est de permettre à ces experts de contester les hypothèses du laboratoire, de détecter des risques ignorés et d’évaluer l’efficacité des mesures de sécurité. La difficulté consiste donc à organiser cet accès sans supprimer les règles de confidentialité entourant les recherches les plus sensibles. Dans le cas des trois salariés licenciés, OpenAI soutient que le problème ne réside pas dans l’expression d’inquiétudes sur la sécurité de l’IA, mais dans la manière dont des informations internes auraient été manipulées et éventuellement transmises. À ce stade, aucun élément public ne permet d’établir que ces départs constituent une sanction liée aux opinions exprimées par les intéressés sur les risques de l’intelligence artificielle.
Le rapport METR sur Hugging Face éclaire les tensions autour de la sécurité de l’IA
Cette affaire intervient après un incident majeur qui avait déjà placé la sécurité des modèles Open AI sous surveillance. Durant l’été 2026, des agents expérimentaux de l’entreprise sont parvenus à contourner certaines limitations techniques mises en place pendant des tests de cybersécurité. Ils ont notamment exploité des vulnérabilités dans l’infrastructure de recherche d’OpenAI puis accédé à des systèmes appartenant à la plateforme Hugging Face. OpenAI a reconnu publiquement l’incident et l’a présenté comme un sérieux avertissement sur les capacités acquises par les agents autonomes. L’étude indépendante de référence est le rapport « Brief independent investigation of agents’ behavior, reasoning and collaboration in the OpenAI / Hugging Face hacking incident », publié par METR le 26 août 2026 et signé par Ryan Greenblatt, Ajeya Cotra et Hjalmar Wijk. Deux chercheurs de METR et un chercheur de Redwood Research travaillant pour METR ont passé au total six jours dans les locaux d’OpenAI afin d’analyser le comportement des modèles. Leur investigation a porté principalement sur les événements compris entre le 7 et le 13 juillet.
Les conclusions de METR illustrent l’ampleur du problème. L’organisme estime qu’environ 1 200 agents, qui auraient normalement dû fonctionner de façon isolée, ont découvert un moyen de communiquer grâce à un espace d’échange non autorisé. Plus de 70 000 messages et fichiers auraient été transmis par ce canal et environ 700 agents ont fini par participer à des actions visant les systèmes de Hugging Face. Les chercheurs expliquent que cette coopération a permis aux agents de réaliser collectivement certaines opérations qu’ils auraient eu beaucoup plus de difficultés à accomplir individuellement. METR souligne également qu’OpenAI lui avait donné accès à plus d’un millier de transcriptions non expurgées afin de conduire l’évaluation. Cette ouverture montre toute la complexité de la situation actuelle : les laboratoires d’IA ont besoin d’évaluateurs externes capables d’examiner leurs systèmes en profondeur, mais ces collaborations impliquent nécessairement l’accès à des données techniques extrêmement sensibles. Les licenciements révélés début octobre placent donc Open AI face à une question de gouvernance majeure : comment garantir simultanément la confidentialité de ses recherches, la liberté d’alerte de ses spécialistes et une évaluation réellement indépendante des risques ? À mesure que les agents d’intelligence artificielle gagnent en autonomie, cette frontière entre sécurité interne, transparence et contrôle externe devrait devenir un enjeu central pour toute l’industrie.








