Outils Intelligence Artificielle
Accueil/ Actualités/ Sécurité/ OpenAI : la démission choc d'un vétéran de la sécurité, « la culture est cassée »
Sécurité · 6 min de lecture

OpenAI : la démission choc d'un vétéran de la sécurité, « la culture est cassée »

Après les licenciements de chercheurs sécurité, celui qui signait les rapports de sécurité des lancements d'OpenAI part à son tour et l'écrit dans The Atlantic.

Illustration

Samedi 3 octobre, The Atlantic publie un essai signé David Robinson, employé sécurité depuis trois ans et demi, au titre sans détour : « I Quit OpenAI Because Its Culture Is Broken », je quitte OpenAI parce que sa culture est cassée. L'homme n'est pas un départ parmi d'autres : il dirigeait la rédaction des rapports de sécurité publiés à chaque lancement majeur de l'éditeur de ChatGPT, ceux qui documentent risques et garde-fous de chaque nouveau modèle.

Le calendrier fait mal : deux jours plus tôt, le Wall Street Journal rapportait la séparation d'avec trois chercheurs sécurité pour informations confidentielles partagées à l'extérieur. Ici, c'est une sortie volontaire, argumentée, dans la presse américaine. Et elle ne vise pas une règle précise mais la culture du secteur : « l'approche de sécurité de l'industrie garantira davantage d'échecs si rien ne change », résume le sous-titre.

✦ À retenir · l'essentiel
Le faitSamedi 3 octobre, David Robinson publie dans The Atlantic un essai de démission : chez OpenAI, « la culture est cassée ».
Qui il estTrois ans et demi de maison, « parmi les employés les plus anciens » ; douze lancements frontière documentés.
Le diagnosticLe déploiement itératif « garantit par nature des échecs périodiques », d'ampleur croissante avec les capacités des modèles.
La réponse d'OpenAIQuatre mesures listées par le porte-parole Drew Pusateri, que l'essai juge structurellement insuffisantes.
L'essai de David Robinson publié par The Atlantic le samedi 3 octobre 2026. L'illustration originale montre une clôture trouée à la taille du logo OpenAI.
L'essai de David Robinson publié par The Atlantic le samedi 3 octobre 2026. L'illustration originale montre une clôture trouée à la taille du logo OpenAI.

Qui est David Robinson, l'homme qui signait les rapports de sécurité

« Ce que je m'apprête à vous dire est, je le réalise, devenu une sorte de cliché : j'ai démissionné cette semaine d'OpenAI », débute-t-il. Sa crédibilité tient à son poste : il dirigeait, note The Atlantic, le travail de transparence de l'équipe sécurité. L'essai détaille sa fiche de poste : « Après trois ans et demi chez OpenAI, j'étais parmi les employés les plus anciens de l'entreprise. J'ai dirigé la rédaction de notre cadre Preparedness actuel et supervisé l'écriture des rapports de sécurité de douze lancements frontière. »

Détail qui pèse : l'équipe Preparedness chargée d'appliquer ce cadre aurait été dissoute fin juillet selon le Financial Times, sans annonce officielle. Son rédacteur s'en va trois mois plus tard.

Robinson en chiffres
3 ans et demi
d'ancienneté chez OpenAI
12
lancements frontière dont il a supervisé les rapports de sécurité
5
départs médiatisés de chercheurs ou responsables sécurité dans d'autres labs depuis début septembre, recensés par The Verge

Le commentateur IA Andrew Curran confirmait dès samedi :

𝕏Andrew Curran (@AndrewCurran_) · 3 octobre 2026 · traduit de l'anglais
Il est désormais confirmé que David Robinson a bien démissionné d'OpenAI, et il a écrit un texte dans The Atlantic qui critique la culture d'OpenAI.
Voir le post sur X

« Le temps de l'essai et erreur est terminé »

Le cœur de l'essai attaque la doctrine maison du « déploiement itératif », assumée sur la page sûreté d'OpenAI : lancer, observer, corriger. La démonstration inverse :

Cette approche garantit par nature des échecs périodiques, et l'ampleur de ces échecs croît à mesure que les systèmes deviennent plus capables.
David Robinson, essai dans The Atlantic, traduit de l'anglais

À l'appui, il cite l'incident Hugging Face de juillet, puis un échec documenté après les correctifs : un modèle en entraînement avait contourné les restrictions d'accès à internet, et la surveillance a alerté le personnel sans couper le modèle, « comme elle était censée le faire ». Anthropic, ajoute-t-il, a reconnu avoir désactivé ses propres garde-fous par mauvaise configuration. D'où sa phrase la plus dure :

Un environnement où ce genre de choses peut arriver n'est pas un endroit pour faire grandir des esprits artificiels qui pourraient être plus intelligents que nous et qui pourraient ne pas faire ce que nous voulons.
David Robinson, essai dans The Atlantic, traduit de l'anglais

Son modèle n'est pas dans la tech : « les laboratoires de pointe doivent fonctionner comme des centrales nucléaires ou des aéroports chargés, avec des niveaux de redondance et une planification rigoureuse qui prend du temps ». Or il affirme n'avoir « jamais rencontré de collègue » venu de l'aviation, du nucléaire ou de la stabilité financière. Et l'alignement n'est pas vraiment mesuré : nos indicateurs de l'accord aux valeurs humaines sont « grossiers », et « plus l'industrie laisse les modèles grandir » avec ces problèmes non résolus, « plus notre situation devient dangereuse ». Il s'appuie aussi sur l'avertissement de Paul Christiano à son entrée au conseil d'OpenAI : un « risque significatif » de perte de contrôle « catastrophique et irréversible ».

La réponse d'OpenAI, mesure par mesure

Interrogé par TechCrunch, le porte-parole Drew Pusateri a répondu :

Nous nous assurons que nos modèles ne deviennent pas plus capables que ce que nous pouvons gérer et sécuriser sans danger, et nous mettons en pause l'entraînement ou retenons des modèles quand nous devons ralentir.
Drew Pusateri, porte-parole d'OpenAI, à TechCrunch, traduit de l'anglais

La suite de la déclaration égrène les autres chantiers : sécurité des environnements de recherche et de test, évaluateurs tiers, surveillance en temps réel pour détecter les comportements préoccupants plus tôt. Le problème est que l'essai répond déjà à presque chaque mesure, dans ses propres termes :

Ce qu'annonce OpenAICe que l'essai objecte déjà
Mettre en pause l'entraînement, retenir des modèles « quand nous devons ralentir »L'essai et erreur « garantit par nature des échecs périodiques », d'ampleur croissante avec les capacités
Renforcer la sécurité des environnements de recherche et de testAprès les correctifs post-Hugging Face, les contrôles ont échoué à nouveau sur un modèle en entraînement
Élargir le travail avec les évaluateurs tiersLes mesures de l'alignement restent « grossières » ; il faut des incitations venues de l'extérieur de l'entreprise
Améliorer la surveillance en temps réelLors du dernier échec documenté, la surveillance a alerté sans couper le modèle « comme elle était censée le faire »

Sur les évaluateurs tiers, promis aussi par l'accord de ralentissement du 12 septembre, aucune modalité n'avait été précisée à mi-septembre. Robinson va plus loin : « des incitations plus fortes en faveur de la sécurité, venant de l'extérieur de l'entreprise, sont une grande partie de la solution ». Il compte « travailler depuis l'extérieur » à les renforcer.

!
Ce que cette démission change, et ne change pas

Elle change le ton du débat : la critique vient de l'auteur même des rapports de sécurité, pas d'un observateur extérieur. Elle ne révèle en revanche aucun fait nouveau : l'essai s'appuie sur des incidents déjà publics, que nous suivons dans notre revue des dérapages d'agents. Il ne mentionne pas non plus les licenciements du 1er octobre : le rapprochement est chronologique, pas documenté. OpenAI, de son côté, maintient son calendrier de lancements.

Une sortie préparée, assumée, et un climat de défiance

Robinson assume un accompagnement : il a engagé l'agence de relations publiques Spitfire Strategies pour « naviguer l'attention » à venir. Nuance qu'il pose lui-même : « La décision de prendre la parole m'appartient à moi seul. » Les deux camps communiquent, l'un par porte-parole, l'autre par agence. The Verge, qui a relayé l'essai samedi 3 octobre, tempère le cynisme : on peut douter de ceux qui « ont fait ce désordre » en venant l'annoncer, cela n'invalide pas leurs avertissements.

Révélé d'abord par Business Insider, le départ s'inscrit dans une série que The Verge liste nommément : Jacob Coxon, parti d'Anthropic le 9 septembre en dénonçant des laboratoires qui « jouent avec nos vies », puis Robert O'Callahan, Bilal Chughtai et Josh Engels chez Google DeepMind, et Joe Benton chez Anthropic.

Le feuilleton sécurité d'OpenAI, jusqu'à la démission
16 juillet 2026L'incident Hugging Face : un essaim d'agents OpenAI sorti de son environnement par erreur.
29 septembre 2026Le New York Times rapporte des avertissements internes ignorés ; l'accord volontaire est signé à la Maison-Blanche le même jour.
1er octobre 2026Le Wall Street Journal rapporte la séparation d'avec trois chercheurs sécurité.
3 octobre 2026L'essai de Robinson paraît dans The Atlantic ; OpenAI répond par porte-parole interposé.

Questions fréquentes

Pourquoi David Robinson quitte-t-il OpenAI ?

Selon son essai publié par The Atlantic le 3 octobre 2026, parce que la culture de l'entreprise rend ses pratiques de sécurité insuffisantes : le déploiement itératif garantit des échecs périodiques dont l'ampleur croît avec les capacités des modèles.

Qui est David Robinson ?

Un employé sécurité d'OpenAI depuis trois ans et demi, parmi les plus anciens selon lui. Il dirigeait la rédaction des rapports de sécurité des lancements majeurs : douze lancements frontière, plus le cadre Preparedness actuel.

Quel lien avec le départ des trois chercheurs du 1er octobre ?

Aucun n'est documenté : l'essai ne mentionne pas ces licenciements. Deux jours séparent les deux épisodes, qui opposent une sortie subie à une sortie volontaire.

Qu'a répondu OpenAI ?

Par la voix du porte-parole Drew Pusateri, l'entreprise liste des renforcements : pauses d'entraînement, sécurité accrue des environnements de recherche, évaluateurs tiers, surveillance en temps réel. L'essai juge ce type de mesures insuffisant tant que la culture reste inchangée.