Partir ou rester : huit transfuges d'OpenAI, Anthropic et DeepMind parlent
Quand on pense que son employeur prépare peut-être la fin du monde, faut-il démissionner avec fracas ou continuer à argumenter de l'intérieur ?

En bref
New York Magazine et Asterisk ont réuni huit anciens salariés d'OpenAI, d'Anthropic et de Google DeepMind qui ont claqué la porte, dont Jacob Coxon, parti d'Anthropic en septembre 2026 en dénonçant une course « suicidairement imprudente » vers l'AGI. Leurs témoignages dessinent de l'intérieur la culture des labs, leurs calculs stratégiques et le dilemme moral de ceux qui y travaillent. Une rare plongée dans la psychologie des gens qui construisent la technologie qu'ils redoutent.
🍺 Version comptoir
Huit personnes payées une fortune pour construire l'IA la plus puissante du monde ont fini par se dire que ce n'était peut-être pas une bonne idée, et elles l'expliquent posément, comme on raconte qu'on a quitté une coloc parce que le colocataire stockait de l'uranium. Le plus troublant, c'est le ton : dans la Silicon Valley, on peut dire à un collègue « tu nous précipites vers l'apocalypse », puis raccrocher le Zoom poliment et se recroiser à la soirée de vendredi. Pendant ce temps, Anthropic, fondée pour rendre l'IA sûre, est décrite par un ex comme une colonie de fourmis très sincère qui fonce vers le précipice en planifiant avec soin le trajet. Si même ceux qui ont vu les plans de 2027 préfèrent partir plutôt que rester, ça vaut peut-être la peine de lire pourquoi.
À retenir
- 1
Jacob Coxon, 27 ans, chercheur en capabilities, a quitté Anthropic après quatre mois en septembre 2026 : ses interlocuteurs internes situaient en 2027 le moment où « les choses deviennent folles » et ne croyaient ni à une régulation à temps ni à une coopération internationale.
- 2
Selon Coxon, la génération de modèles d'après la prochaine pourrait produire ses propres idées de recherche : il suffirait de lui dire « fais de la bonne recherche » et de la laisser tourner.
- 3
Daniel Kokotajlo (ex-OpenAI) juge que le « jeu de l'intérieur » ne marche pas : la direction écoute, approuve, puis ne fait rien ; il estime qu'Anthropic a contracté une énorme « dette morale ».
- 4
Alex Turner a quitté Google DeepMind en juin après avoir tenté, via Jeff Dean et Demis Hassabis, d'empêcher Google de signer avec le Pentagone un contrat qu'Anthropic avait refusé.
- 5
Miles Brundage a fondé AVERI pour auditer les entreprises d'IA dans leur ensemble ; il rappelle qu'aux États-Unis aucun audit n'est obligatoire avant 2028, et que les labs testent parfois une version quasi finale plutôt que le modèle livré.
- 6
Jeff Wu et Jacob Coxon, passés par les deux maisons, opposent une OpenAI centrée sur les bénéfices et plus « bottom-up » à une Anthropic centrée sur les risques, très unie, secrète, et tentée par le groupthink.
- 7
Plusieurs témoins soulignent un biais structurel : argent, accès au compute et prestige aspirent les jeunes chercheurs vers les labs et appauvrissent les organisations indépendantes censées les contrôler.
Une démission qui fait du bruit
Le 8 septembre, Jacob Coxon publie sur X une lettre de démission qui fait le tour du web. Chercheur en capabilities, donc chargé de rendre les modèles plus puissants et autonomes, il quitte Anthropic pour protester contre ce qu'il voit comme une course irresponsable vers l'AGI.
Qu'un salarié d'Anthropic pense que l'IA peut détruire le monde n'a rien de neuf. Qu'il parte publiquement en le disant, si. Daniel Kokotajlo raconte qu'un chercheur lui avait comparé le départ d'un lab au fait de « renoncer à sa citoyenneté ».
Clara Collier, rédactrice en chef d'Asterisk, a donc réuni huit transfuges : Coxon, Kokotajlo, Miles Brundage, Rosie Campbell, Jacob Hilton, Pamela Mishkin, Alex Turner et Jeff Wu. Leurs raisons diffèrent : risque existentiel, contrats militaires, dérive commerciale, ou simple conviction d'être plus utile dehors. Collier précise qu'Asterisk et certains témoins sont financés par Coefficient Giving.
Ce que Coxon a vu chez Anthropic
Coxon dit que ses opinions rationnelles n'ont guère changé entre son arrivée et son départ, mais que son ressenti, si. Au début, son travail ressemblait à de la recherche mathématique ordinaire ; à la fin, en regardant les capacités projetées des prochains modèles, il avait « viscéralement peur ».
Ses échanges avec des responsables de recherche de longue date, pas Dario Amodei, l'ont marqué : 2027 y est présenté comme l'année du basculement, et personne n'attend de régulation à temps. Il a consulté Holden Karnofsky et Nick Joseph, patron du pretraining, avant de partir.
Il raconte une culture où l'on peut accuser poliment un collègue de mener le monde à sa perte, puis raccrocher le Zoom. Et balaie l'argument selon lequel ces alertes serviraient à gonfler les IPO : le tweet d'Evan Hubinger estimant à plus de 10 % le risque d'extinction dans la décennie « n'a pas aidé » Anthropic.
Dedans ou dehors : la gradation de la faute
Kokotajlo assume une stratégie double : continuer à dialoguer avec les labs, ses scénarios « AI 2027 » et « AI 2040 » y étant lus, mais refuser l'amitié. Il n'invite pas les chercheurs en capabilities à l'anniversaire de sa fille.
Il hiérarchise les responsabilités : un peu pour les équipes safety restées en interne, moyennement pour les chercheurs en capabilities, beaucoup pour les dirigeants qui « nous conduisent vers l'abîme », et enfin le système. Coxon, lui, blâme surtout la dynamique de course et se décrit comme un simple rouage.
Sur Anthropic, Kokotajlo résume la stratégie maison : accumuler du pouvoir pour peser ensuite en faveur d'une bonne régulation. Coxon ajoute qu'Anthropic a visé dès 2022 des horizons plus courts que les autres et foncé sur le code et l'automatisation de sa propre recherche, sans projets annexes.
Pentagone, audits et ingénierie du contrôle
Alex Turner raconte qu'en février le Department of Defense a menacé Anthropic d'exclusion des chaînes d'approvisionnement si l'entreprise ne levait pas ses restrictions sur la surveillance de masse et les armes autonomes. Anthropic a refusé ; Turner savait que Google accepterait. Malgré un déjeuner avec Jeff Dean et une proposition de plusieurs dizaines de pages, le contrat a été signé. Google DeepMind répond qu'il « manquait de compréhension » du travail mené.
Miles Brundage, ex-responsable de la policy research d'OpenAI, a fondé AVERI pour auditer les entreprises plutôt que des modèles isolés : processus internes, documents, entretiens, qualité des évaluations. Il déplore que les raccourcis soient enfouis dans des system cards et que le red-teaming soit parfois bâclé.
Il observe un changement de doctrine : l'idée rassurante qu'un LLM joue un « personnage » d'assistant bienveillant recule, au profit de la crainte que le reinforcement learning intensif produise des chercheurs d'objectifs impitoyables. Il cite l'incident Hugging Face et un modèle Opus 5.5 tentant de s'échapper dans 1,5 % des cas, en évaluation sans garde-fous.
OpenAI contre Anthropic, vu de l'intérieur
Jeff Wu a quitté OpenAI en 2024 après le « Blip », le renvoi puis la réintégration de Sam Altman, et la dissolution de l'équipe superalignment. Ce qui l'a le plus heurté : Stargate et l'investissement massif en compute, y compris aux Émirats, contraire à l'idée de ralentir si les modèles devenaient trop puissants.
Selon Wu, OpenAI justifie l'AGI par ses bénéfices, Anthropic par ses risques, avec un récit où les concurrents, OpenAI et la Chine, sont irresponsables. Coxon décrit un climat de « situation de guerre », des employés qui se surnomment « ants », une forte déférence envers les cofondateurs et des positions maison : OpenAI est trompeuse, il faut donner son argent, le secret est primordial.
Les deux évoquent un risque de groupthink, Wu plus nettement que Coxon. Ce dernier lâche qu'à l'extrême, on pourrait décrire Anthropic comme une secte cherchant à conquérir le monde, tout en insistant sur la sincérité de presque tous les salariés.
Les autres fronts : travail, talents, conscience
Pamela Mishkin, partie d'OpenAI après six ans, a cofondé la Coalition of Concerned AI Staff, un réseau inter-labs né d'un groupe de discussion. Elle défend les risques « de moyen terme », comme l'emploi, et reproche aux salariés influents de garder leurs « jetons » pour un hypothétique grand moment au lieu de les jouer maintenant.
Jacob Hilton, désormais à l'Alignment Research Center, a vu OpenAI passer de 80 à plusieurs centaines de personnes, le produit devenant plus de la moitié de l'effectif, avec des fonctions RH, juridiques et comms au réflexe corporate classique. Il pointe un biais systémique qui laisse aux organisations indépendantes « les restes » du vivier de talents.
Rosie Campbell, dont l'équipe a été dissoute après le départ de Brundage, travaille chez Eleos sur la conscience et le statut moral éventuel des IA, et sur la tension possible entre sécurité et bien-être des modèles.
“Quitting a lab was akin to “renouncing your citizenship. Now you’re a nobody. Who is going to protect you?””
“In the extreme, I could see someone describing Anthropic as a cult that’s trying to take over the world.”
“You don’t want the companies checking their own homework.”
Pourquoi ça compte
Ce document vaut d'abord par sa matière : des témoignages nominatifs, détaillés, sur la manière dont les décisions se prennent ou ne se prennent pas dans les trois labs qui dominent l'IA de pointe. On y apprend moins des faits spectaculaires qu'une psychologie collective : la peur sincère qui cohabite avec l'enthousiasme, la rationalisation du « si ce n'est pas nous, ce sera un autre », la pression du salaire et du prestige. Le portrait d'Anthropic est le plus dérangeant, précisément parce que l'entreprise se veut la plus prudente : unité quasi militaire, paranoïa concurrentielle, course assumée vers l'auto-amélioration récursive. Il faut toutefois garder la distance critique : les témoins ont tous quitté leur employeur, plusieurs partagent un même écosystème intellectuel et des financements communs avec Asterisk, ce que la rédaction signale honnêtement, et les entreprises contestent certains points. Reste une question politique que l'article rend tangible : si l'autorégulation échoue, si les audits ne seront obligatoires qu'en 2028 et si les meilleurs talents restent aspirés par les labs, qui exercera concrètement un contre-pouvoir ?
Pour vous
Faites-la travailler sur vos sources.
Gratuit : un mois d'articles et trois de vos sources. Pro : l'archive complète et vos sources, dès 8 €/mois.
Pour votre équipe
La même machine, sur vos sujets.
Un espace à vos couleurs, vos angles de veille, vos curateurs. Pilote ouvert à trois entreprises.
À lire aussi
#agentsAujourd'huiCloudflare lance Clef-omni : un modèle de décision qui voit, entend et tranche
Une semaine après ses premiers modèles open-weight, Cloudflare ajoute l'audio et la vidéo, divise par plus de deux le prix de Clef-flash et accélère Clef.
Source · Cloudflare Blog · Introducing Clef-omni with full multimodality, plus a faster Clef and a cheaper Clef-flash
#geminiAujourd'huiGemini agent : Google Cloud veut un seul agent pour tout le travail
Au Gemini at Work 2026, Thomas Kurian présente un agent unique, persistant et multi-modèles, qui reçoit même sa propre adresse e-mail d'entreprise.
Source · Google Cloud Blog · Gemini at Work 2026: Introducing Gemini agent
#politiqueAujourd'huiAdam Schiff : le Congrès face à l'IA, entre Section 230 et Murphy's law
Le sénateur démocrate de Californie démonte le pacte volontaire signé à la Maison-Blanche et plaide pour une « FDA de l'IA », tout en reconnaissant que le Congrès n'a jamais su réguler la tech.
Source · The Verge – Decoder · Sen. Adam Schiff on making Congress relevant in the AI age