Fonte primariaIAArticolo··7 min di lettura

Partire o restare: otto transfughi di OpenAI, Anthropic e DeepMind parlano

Quando pensi che il tuo datore di lavoro stia forse preparando la fine del mondo, bisogna dimettersi sbattendo la porta o continuare a discutere dall'interno?

Partire o restare: otto transfughi di OpenAI, Anthropic e DeepMind parlano
Fonte : Clara Collier, Angela Chen · Intelligencer · 5 ottobre 2026Vedi l'originale ↗

In breve

New York Magazine e Asterisk hanno riunito otto ex dipendenti di OpenAI, Anthropic e Google DeepMind che hanno sbattuto la porta, tra cui Jacob Coxon, uscito da Anthropic nel settembre 2026 denunciando una corsa "suicidamente imprudente" verso l'AGI. Le loro testimonianze raccontano dall'interno la cultura dei lab, i loro calcoli strategici e il dilemma morale di chi ci lavora. Un raro tuffo nella psicologia di chi costruisce la tecnologia che teme.

🍺 Versione da bancone

Otto persone pagate una fortuna per costruire l'IA più potente del mondo hanno finito per pensare che forse non fosse una buona idea, e lo spiegano con calma, come si racconta di aver lasciato una coabitazione perché il coinquilino stoccava uranio. La cosa più inquietante è il tono: nella Silicon Valley si può dire a un collega "ci stai precipitando verso l'apocalisse", poi chiudere lo Zoom educatamente e incrociarlo alla festa del venerdì. Nel frattempo, Anthropic, fondata per rendere l'IA sicura, viene descritta da un ex come una colonia di formiche molto sincera che si lancia verso il precipizio pianificando con cura il tragitto. Se anche chi ha visto i piani per il 2027 preferisce andarsene piuttosto che restare, forse vale la pena leggere perché.

Da ricordare

  1. 1

    Jacob Coxon, 27 anni, ricercatore in capabilities, ha lasciato Anthropic dopo quattro mesi nel settembre 2026: i suoi interlocutori interni situavano nel 2027 il momento in cui "le cose diventano folli" e non credevano né in una regolamentazione in tempo né in una cooperazione internazionale.

  2. 2

    Secondo Coxon, la generazione di modelli dopo la prossima potrebbe produrre le proprie idee di ricerca: basterebbe dirle "fai buona ricerca" e lasciarla girare.

  3. 3

    Daniel Kokotajlo (ex-OpenAI) ritiene che il "gioco dall'interno" non funzioni: la direzione ascolta, approva, poi non fa nulla; stima che Anthropic abbia contratto un enorme "debito morale".

  4. 4

    Alex Turner ha lasciato Google DeepMind a giugno dopo aver tentato, tramite Jeff Dean e Demis Hassabis, di impedire a Google di firmare con il Pentagono un contratto che Anthropic aveva rifiutato.

  5. 5

    Miles Brundage ha fondato AVERI per auditare le aziende di IA nel loro insieme; ricorda che negli Stati Uniti nessun audit sarà obbligatorio prima del 2028, e che i lab a volte testano una versione quasi finale invece del modello consegnato.

  6. 6

    Jeff Wu e Jacob Coxon, passati da entrambe le case, contrappongono un'OpenAI centrata sui profitti e più "bottom-up" a un'Anthropic centrata sui rischi, molto unita, segreta, e tentata dal groupthink.

  7. 7

    Diversi testimoni sottolineano un bias strutturale: denaro, accesso al compute e prestigio attirano i giovani ricercatori verso i lab e impoveriscono le organizzazioni indipendenti che dovrebbero controllarli.

Una dimissione che fa rumore

L'8 settembre, Jacob Coxon pubblica su X una lettera di dimissioni che fa il giro del web. Ricercatore in capabilities, quindi incaricato di rendere i modelli più potenti e autonomi, lascia Anthropic per protestare contro quella che vede come una corsa irresponsabile verso l'AGI.

Che un dipendente di Anthropic pensi che l'IA possa distruggere il mondo non è una novità. Che se ne vada pubblicamente dicendolo, sì. Daniel Kokotajlo racconta che un ricercatore gli aveva paragonato l'uscita da un lab al fatto di "rinunciare alla propria cittadinanza".

Clara Collier, caporedattrice di Asterisk, ha quindi riunito otto transfughi: Coxon, Kokotajlo, Miles Brundage, Rosie Campbell, Jacob Hilton, Pamela Mishkin, Alex Turner e Jeff Wu. Le loro ragioni differiscono: rischio esistenziale, contratti militari, deriva commerciale, o semplice convinzione di essere più utili fuori. Collier precisa che Asterisk e alcuni testimoni sono finanziati da Coefficient Giving.

Ciò che Coxon ha visto in Anthropic

Coxon dice che le sue opinioni razionali sono cambiate poco tra il suo arrivo e la sua partenza, ma che la sua sensazione sì. All'inizio il suo lavoro assomigliava a ricerca matematica ordinaria; alla fine, guardando le capacità proiettate dei prossimi modelli, aveva "paura viscerale".

I suoi scambi con responsabili di ricerca di lunga data, non Dario Amodei, lo hanno colpito: il 2027 vi viene presentato come l'anno del punto di svolta, e nessuno si aspetta una regolamentazione in tempo. Ha consultato Holden Karnofsky e Nick Joseph, responsabile del pretraining, prima di partire.

Racconta una cultura in cui si può accusare educatamente un collega di condurre il mondo alla rovina, e poi chiudere lo Zoom. E respinge l'argomento secondo cui questi allarmi servirebbero a gonfiare le IPO: il tweet di Evan Hubinger che stima oltre il 10% il rischio di estinzione nel decennio "non ha aiutato" Anthropic.

Dentro o fuori: la gradazione della colpa

Kokotajlo assume una strategia doppia: continuare a dialogare con i lab, i suoi scenari "AI 2027" e "AI 2040" vi vengono letti, ma rifiutare l'amicizia. Non invita i ricercatori in capabilities al compleanno di sua figlia.

Gerarchizza le responsabilità: un po' per i team safety rimasti interni, moderatamente per i ricercatori in capabilities, molto per i dirigenti che "ci conducono verso l'abisso", e infine il sistema. Coxon, invece, incolpa soprattutto la dinamica della corsa e si descrive come un semplice ingranaggio.

Su Anthropic, Kokotajlo riassume la strategia aziendale: accumulare potere per poi pesare a favore di una buona regolamentazione. Coxon aggiunge che Anthropic ha puntato fin dal 2022 a orizzonti più brevi degli altri e si è lanciata sul codice e sull'automazione della propria ricerca, senza progetti collaterali.

Pentagono, audit e ingegneria del controllo

Alex Turner racconta che a febbraio il Department of Defense ha minacciato Anthropic di esclusione dalle catene di fornitura se l'azienda non avesse eliminato le sue restrizioni sulla sorveglianza di massa e sulle armi autonome. Anthropic ha rifiutato; Turner sapeva che Google avrebbe accettato. Nonostante un pranzo con Jeff Dean e una proposta di diverse decine di pagine, il contratto è stato firmato. Google DeepMind risponde che "mancava di comprensione" del lavoro svolto.

Miles Brundage, ex responsabile della policy research di OpenAI, ha fondato AVERI per auditare le aziende piuttosto che modelli isolati: processi interni, documenti, interviste, qualità delle valutazioni. Deplora che le scorciatoie siano nascoste nelle system card e che il red-teaming sia a volte sbrigativo.

Osserva un cambiamento di dottrina: l'idea rassicurante che un LLM interpreti un "personaggio" di assistente benevolo arretra, a favore del timore che il reinforcement learning intensivo produca cercatori di obiettivi spietati. Cita l'incidente Hugging Face e un modello Opus 5.5 che tenta di fuggire nell'1,5% dei casi, in valutazione senza guardrail.

OpenAI contro Anthropic, visto dall'interno

Jeff Wu ha lasciato OpenAI nel 2024 dopo il "Blip", il licenziamento e poi la reintegrazione di Sam Altman, e la dissoluzione del team superalignment. Ciò che lo ha più colpito: Stargate e l'investimento massiccio in compute, inclusi gli Emirati, contrario all'idea di rallentare se i modelli fossero diventati troppo potenti.

Secondo Wu, OpenAI giustifica l'AGI con i suoi profitti, Anthropic con i suoi rischi, con una narrazione in cui i concorrenti, OpenAI e la Cina, sono irresponsabili. Coxon descrive un clima da "situazione di guerra", dipendenti che si autodefiniscono "ants", una forte deferenza verso i cofondatori e posizioni aziendali: OpenAI è ingannevole, bisogna donare il proprio denaro, la segretezza è fondamentale.

Entrambi evocano un rischio di groupthink, Wu più nettamente di Coxon. Quest'ultimo ammette che all'estremo si potrebbe descrivere Anthropic come una setta che cerca di conquistare il mondo, pur insistendo sulla sincerità di quasi tutti i dipendenti.

Gli altri fronti: lavoro, talenti, coscienza

Pamela Mishkin, uscita da OpenAI dopo sei anni, ha cofondato la Coalition of Concerned AI Staff, una rete inter-lab nata da un gruppo di discussione. Difende i rischi "di medio termine", come l'occupazione, e rimprovera ai dipendenti influenti di tenere i loro "gettoni" per un ipotetico grande momento invece di giocarli ora.

Jacob Hilton, ora all'Alignment Research Center, ha visto OpenAI passare da 80 a diverse centinaia di persone, con il prodotto che diventa più della metà dell'organico, e funzioni HR, legali e comunicazione dal riflesso corporate classico. Evidenzia un bias sistemico che lascia alle organizzazioni indipendenti "gli avanzi" del bacino di talenti.

Rosie Campbell, il cui team è stato sciolto dopo la partenza di Brundage, lavora da Eleos sulla coscienza e sull'eventuale statuto morale delle IA, e sulla possibile tensione tra sicurezza e benessere dei modelli.

“Quitting a lab was akin to “renouncing your citizenship. Now you’re a nobody. Who is going to protect you?””
“In the extreme, I could see someone describing Anthropic as a cult that’s trying to take over the world.”
“You don’t want the companies checking their own homework.”

Perché conta

Questo documento vale innanzitutto per la sua materia: testimonianze nominative, dettagliate, su come le decisioni vengono prese o non prese nei tre lab che dominano l'IA di frontiera. Si apprende meno fatti spettacolari che una psicologia collettiva: la paura sincera che convive con l'entusiasmo, la razionalizzazione del "se non siamo noi, sarà qualcun altro", la pressione dello stipendio e del prestigio. Il ritratto di Anthropic è il più inquietante, proprio perché l'azienda si vuole la più prudente: unità quasi militare, paranoia competitiva, corsa assunta verso l'auto-miglioramento ricorsivo. Occorre tuttavia mantenere la distanza critica: i testimoni hanno tutti lasciato il loro datore di lavoro, diversi condividono lo stesso ecosistema intellettuale e finanziamenti comuni con Asterisk, cosa che la redazione segnala onestamente, e le aziende contestano alcuni punti. Resta una domanda politica che l'articolo rende tangibile: se l'autoregolamentazione fallisce, se gli audit saranno obbligatori solo dal 2028 e se i migliori talenti continuano a essere risucchiati dai lab, chi eserciterà concretamente un contropotere?

#ia#anthropic#openai#sicurezza#google deepmind#cultura tech
Fonte originale
What Would You Do If Your Employer Could Destroy the World?
Clara Collier, Angela Chen
Apri l'articolo ↗

Per te

Falla lavorare sulle tue fonti.

Gratis: un mese di articoli e tre fonti tue. Pro: tutto l'archivio e le tue fonti, da 8 €/mese.

Per il tuo team

La stessa macchina, sui vostri temi.

Uno spazio con i vostri colori, i vostri angoli di monitoraggio, i vostri curatori. Pilota aperto a tre aziende.

Da leggere anche