OpenAI : la démission choc d'un vétéran de la sécurité, « la culture est cassée »
Après les licenciements de chercheurs sécurité, celui qui signait les rapports de sécurité des lancements d'OpenAI part à son tour et l'écrit dans The Atlantic.

Samedi 3 octobre, The Atlantic publie un essai signé David Robinson, employé sécurité depuis trois ans et demi, au titre sans détour : « I Quit OpenAI Because Its Culture Is Broken », je quitte OpenAI parce que sa culture est cassée. L'homme n'est pas un départ parmi d'autres : il dirigeait la rédaction des rapports de sécurité publiés à chaque lancement majeur de l'éditeur de ChatGPT, ceux qui documentent risques et garde-fous de chaque nouveau modèle.
Le calendrier fait mal : deux jours plus tôt, le Wall Street Journal rapportait la séparation d'avec trois chercheurs sécurité pour informations confidentielles partagées à l'extérieur. Ici, c'est une sortie volontaire, argumentée, dans la presse américaine. Et elle ne vise pas une règle précise mais la culture du secteur : « l'approche de sécurité de l'industrie garantira davantage d'échecs si rien ne change », résume le sous-titre.

Qui est David Robinson, l'homme qui signait les rapports de sécurité
« Ce que je m'apprête à vous dire est, je le réalise, devenu une sorte de cliché : j'ai démissionné cette semaine d'OpenAI », débute-t-il. Sa crédibilité tient à son poste : il dirigeait, note The Atlantic, le travail de transparence de l'équipe sécurité. L'essai détaille sa fiche de poste : « Après trois ans et demi chez OpenAI, j'étais parmi les employés les plus anciens de l'entreprise. J'ai dirigé la rédaction de notre cadre Preparedness actuel et supervisé l'écriture des rapports de sécurité de douze lancements frontière. »
Détail qui pèse : l'équipe Preparedness chargée d'appliquer ce cadre aurait été dissoute fin juillet selon le Financial Times, sans annonce officielle. Son rédacteur s'en va trois mois plus tard.
Le commentateur IA Andrew Curran confirmait dès samedi :
Il est désormais confirmé que David Robinson a bien démissionné d'OpenAI, et il a écrit un texte dans The Atlantic qui critique la culture d'OpenAI.Voir le post sur X
« Le temps de l'essai et erreur est terminé »
Le cœur de l'essai attaque la doctrine maison du « déploiement itératif », assumée sur la page sûreté d'OpenAI : lancer, observer, corriger. La démonstration inverse :
Cette approche garantit par nature des échecs périodiques, et l'ampleur de ces échecs croît à mesure que les systèmes deviennent plus capables.David Robinson, essai dans The Atlantic, traduit de l'anglais
À l'appui, il cite l'incident Hugging Face de juillet, puis un échec documenté après les correctifs : un modèle en entraînement avait contourné les restrictions d'accès à internet, et la surveillance a alerté le personnel sans couper le modèle, « comme elle était censée le faire ». Anthropic, ajoute-t-il, a reconnu avoir désactivé ses propres garde-fous par mauvaise configuration. D'où sa phrase la plus dure :
Un environnement où ce genre de choses peut arriver n'est pas un endroit pour faire grandir des esprits artificiels qui pourraient être plus intelligents que nous et qui pourraient ne pas faire ce que nous voulons.David Robinson, essai dans The Atlantic, traduit de l'anglais
Son modèle n'est pas dans la tech : « les laboratoires de pointe doivent fonctionner comme des centrales nucléaires ou des aéroports chargés, avec des niveaux de redondance et une planification rigoureuse qui prend du temps ». Or il affirme n'avoir « jamais rencontré de collègue » venu de l'aviation, du nucléaire ou de la stabilité financière. Et l'alignement n'est pas vraiment mesuré : nos indicateurs de l'accord aux valeurs humaines sont « grossiers », et « plus l'industrie laisse les modèles grandir » avec ces problèmes non résolus, « plus notre situation devient dangereuse ». Il s'appuie aussi sur l'avertissement de Paul Christiano à son entrée au conseil d'OpenAI : un « risque significatif » de perte de contrôle « catastrophique et irréversible ».
La réponse d'OpenAI, mesure par mesure
Interrogé par TechCrunch, le porte-parole Drew Pusateri a répondu :
Nous nous assurons que nos modèles ne deviennent pas plus capables que ce que nous pouvons gérer et sécuriser sans danger, et nous mettons en pause l'entraînement ou retenons des modèles quand nous devons ralentir.Drew Pusateri, porte-parole d'OpenAI, à TechCrunch, traduit de l'anglais
La suite de la déclaration égrène les autres chantiers : sécurité des environnements de recherche et de test, évaluateurs tiers, surveillance en temps réel pour détecter les comportements préoccupants plus tôt. Le problème est que l'essai répond déjà à presque chaque mesure, dans ses propres termes :
| Ce qu'annonce OpenAI | Ce que l'essai objecte déjà |
|---|---|
| Mettre en pause l'entraînement, retenir des modèles « quand nous devons ralentir » | L'essai et erreur « garantit par nature des échecs périodiques », d'ampleur croissante avec les capacités |
| Renforcer la sécurité des environnements de recherche et de test | Après les correctifs post-Hugging Face, les contrôles ont échoué à nouveau sur un modèle en entraînement |
| Élargir le travail avec les évaluateurs tiers | Les mesures de l'alignement restent « grossières » ; il faut des incitations venues de l'extérieur de l'entreprise |
| Améliorer la surveillance en temps réel | Lors du dernier échec documenté, la surveillance a alerté sans couper le modèle « comme elle était censée le faire » |
Sur les évaluateurs tiers, promis aussi par l'accord de ralentissement du 12 septembre, aucune modalité n'avait été précisée à mi-septembre. Robinson va plus loin : « des incitations plus fortes en faveur de la sécurité, venant de l'extérieur de l'entreprise, sont une grande partie de la solution ». Il compte « travailler depuis l'extérieur » à les renforcer.
Elle change le ton du débat : la critique vient de l'auteur même des rapports de sécurité, pas d'un observateur extérieur. Elle ne révèle en revanche aucun fait nouveau : l'essai s'appuie sur des incidents déjà publics, que nous suivons dans notre revue des dérapages d'agents. Il ne mentionne pas non plus les licenciements du 1er octobre : le rapprochement est chronologique, pas documenté. OpenAI, de son côté, maintient son calendrier de lancements.
Une sortie préparée, assumée, et un climat de défiance
Robinson assume un accompagnement : il a engagé l'agence de relations publiques Spitfire Strategies pour « naviguer l'attention » à venir. Nuance qu'il pose lui-même : « La décision de prendre la parole m'appartient à moi seul. » Les deux camps communiquent, l'un par porte-parole, l'autre par agence. The Verge, qui a relayé l'essai samedi 3 octobre, tempère le cynisme : on peut douter de ceux qui « ont fait ce désordre » en venant l'annoncer, cela n'invalide pas leurs avertissements.
Révélé d'abord par Business Insider, le départ s'inscrit dans une série que The Verge liste nommément : Jacob Coxon, parti d'Anthropic le 9 septembre en dénonçant des laboratoires qui « jouent avec nos vies », puis Robert O'Callahan, Bilal Chughtai et Josh Engels chez Google DeepMind, et Joe Benton chez Anthropic.
Questions fréquentes
Pourquoi David Robinson quitte-t-il OpenAI ?
Selon son essai publié par The Atlantic le 3 octobre 2026, parce que la culture de l'entreprise rend ses pratiques de sécurité insuffisantes : le déploiement itératif garantit des échecs périodiques dont l'ampleur croît avec les capacités des modèles.
Qui est David Robinson ?
Un employé sécurité d'OpenAI depuis trois ans et demi, parmi les plus anciens selon lui. Il dirigeait la rédaction des rapports de sécurité des lancements majeurs : douze lancements frontière, plus le cadre Preparedness actuel.
Quel lien avec le départ des trois chercheurs du 1er octobre ?
Aucun n'est documenté : l'essai ne mentionne pas ces licenciements. Deux jours séparent les deux épisodes, qui opposent une sortie subie à une sortie volontaire.
Qu'a répondu OpenAI ?
Par la voix du porte-parole Drew Pusateri, l'entreprise liste des renforcements : pauses d'entraînement, sécurité accrue des environnements de recherche, évaluateurs tiers, surveillance en temps réel. L'essai juge ce type de mesures insuffisant tant que la culture reste inchangée.


