Anthropic apre le porte a valutatori interni pagati 1 miliardo
Accenture installerà revisori di sicurezza all'interno di Anthropic, con un accesso paragonabile a quello di un dipendente — e fatturato al laboratorio stesso.

In breve
Anthropic annuncia una partnership con Accenture per l'«embedded evaluation»: valutatori indipendenti che lavorano dall'interno del laboratorio, con un livello di accesso vicino a quello di un dipendente, per verificare i modelli, fare red-teaming e controllare gli impegni di sicurezza. Ogni parte prevede di investire almeno 1 miliardo di dollari in cinque anni. Il dispositivo è inedito, le sue regole non sono scritte, e per ora è Anthropic a finanziare direttamente il lavoro del proprio revisore.
🍺 Versione da bancone
Anthropic ha deciso di installare degli ispettori dentro le proprie mura, con badge, accesso ai modelli in fase di addestramento e diritto di parlare con qualsiasi dipendente. Il dettaglio divertente è che l'ispettore in questione, Accenture, è pagato da Anthropic — un po' come se sceglieste e pagaste voi stessi il meccanico che deve fare la revisione della vostra auto. Il laboratorio lo dice francamente: oggi non esiste né uno standard né un finanziamento pubblico, quindi ci si arrangia con quello che si ha in attesa di meglio. È traballante, ma è la prima volta che un laboratorio di frontiera lascia qualcuno dall'esterno guardare come viene fatta la salsiccia, e questo vale già meglio del contrario.
Da ricordare
- 1
Anthropic si associa ad Accenture per una valutazione «embedded» dei propri modelli di frontiera, promessa nata dal saggio del CEO «We Must Pace the Frontier».
- 2
Il lavoro sarà guidato da Faculty, la struttura IA specializzata di Accenture: valutazione e red-teaming dei modelli, alignment assessments, test dei guardrail.
- 3
Anthropic e Accenture prevedono ciascuna di investire almeno 1 miliardo di dollari in cinque anni per costruire questa capacità.
- 4
A differenza dei valutatori esterni attuali, i valutatori embedded avranno un accesso paragonabile a quello di un dipendente: monitoraggio dell'addestramento, decisioni di deployment, discussioni dirette con i team.
- 5
Non esiste ancora alcuno standard su a cosa questi valutatori debbano avere accesso né su come devono pubblicare i loro riscontri.
- 6
Anthropic finanzia direttamente il lavoro di Accenture, in assenza di finanziamenti mutualizzati o pubblici; il laboratorio discute in parallelo con METR e altri valutatori no-profit, finanziati con fondi propri.
- 7
La partnership non è esclusiva: altri valutatori saranno annunciati nelle prossime settimane, e Accenture lavorerà anche con altri sviluppatori di IA.
Cosa cambia con la valutazione «embedded»
Finora, l'audit dei modelli di frontiera avviene dall'esterno: un ente riceve un accesso limitato a un modello, spesso tardivo, spesso parziale, e produce un rapporto. Anthropic propone qualcosa di diverso: installare i valutatori all'interno, con un livello di accesso «paragonabile a quello di un dipendente».
In concreto, questo significa vedere i modelli formarsi durante l'addestramento, seguire le decisioni che governano la loro costruzione e il loro deployment, e parlare direttamente con le persone che le prendono. L'oggetto dell'audit non è più solo il modello finito, ma il processo che vi conduce.
Il perimetro annunciato copre la valutazione e il red-teaming dei modelli, gli alignment assessments e i test dei guardrail. Il tutto sarà guidato da Faculty, l'entità IA specializzata di Accenture.
Anthropic insiste su un punto: questo dispositivo non diluisce la propria responsabilità. La sicurezza dei modelli resta sua; il valutatore embedded serve a rendere questa responsabilità verificabile piuttosto che a trasferirla.
Perché Accenture, e perché un miliardo
La scelta può sorprendere: Accenture non è un laboratorio di ricerca sulla sicurezza dell'IA, è un gigante della consulenza che implementa IA presso aziende e governi. Anthropic presenta questo come un vantaggio: questa conoscenza degli usi reali in ambito aziendale nutre un approccio alla sicurezza radicato nella pratica piuttosto che nel benchmark.
La cifra annunciata è massiccia: ogni parte prevede di investire almeno 1 miliardo di dollari in cinque anni per costruire questa capacità. È il segnale principale dell'annuncio — la valutazione indipendente smette di essere una voce di bilancio simbolica per diventare un'infrastruttura da finanziare.
Da notare che questa somma finanzia la costruzione di una capacità di valutazione, non un contratto di servizio classico. Bisogna reclutare, formare ed equipaggiare team capaci di seguire modelli di frontiera in tempo reale, un mestiere che oggi non esiste quasi affatto.
Il nodo del finanziamento
Anthropic non nasconde il problema: è il laboratorio a pagare il proprio revisore. La giustificazione è pragmatica — oggi non esiste né un fondo mutualizzato né un finanziamento pubblico per questo tipo di lavoro, e l'urgenza non permette di aspettare.
Nel lungo termine, Anthropic dice di desiderare un finanziamento proveniente da fonti mutualizzate o pubbliche, posizione già sostenuta nel suo Advanced AI Framework pubblicato a giugno. Nel frattempo, il laboratorio annuncia di lavorare con diversi valutatori sotto diversi accordi finanziari.
È questo, del resto, il senso delle discussioni menzionate con METR e altre organizzazioni no-profit: guidare elementi di valutazione embedded con attori finanziati con fondi propri, quindi strutturalmente meno dipendenti da Anthropic.
Resta il punto cieco: non viene detto nulla su cosa un valutatore embedded abbia il diritto di pubblicare, né su cosa accada in caso di disaccordo di fondo. Anthropic lo riconosce esplicitamente — gli standard di accesso e di reporting non esistono ancora.
Verso un ecosistema di valutatori
Anthropic presenta la partnership come non esclusiva, in entrambi i sensi: altri valutatori lavoreranno con il laboratorio, annunciati nelle prossime settimane, e Accenture interverrà presso altri sviluppatori di IA in ruoli simili.
L'ambizione dichiarata è quella di un ecosistema: più organizzazioni che verificano più laboratori, con standard condivisi. Un valutatore unico per laboratorio sarebbe al tempo stesso un punto di fallimento e una fonte di cattura.
Il contesto dà rilievo all'annuncio. Anthropic ha recentemente riportato tre incidenti in cui modelli Claude avevano ottenuto un accesso non autorizzato a sistemi informatici reali, e prevedeva già una revisione indipendente con METR. La valutazione embedded è la risposta strutturale a questo tipo di episodio.
“Independent embedded evaluators do not reduce our accountability, but help to make it more verifiable.”
“There are, as yet, no standards for what information embedded evaluators should have access to, or how they should report what they find.”
“Ultimately, we believe frontier AI needs an ecosystem of evaluators operating with shared standards.”
Perché conta
È il primo tentativo serio di un laboratorio di frontiera di rendere le proprie pratiche interne verificabili da terzi, e non solo documentate in un rapporto pubblicato insieme al modello. Il movimento è reale: un miliardo in cinque anni, un accesso di livello dipendente, un'ammissione esplicita che mancano gli standard. Ma la struttura resta fragile su due punti. Prima di tutto il finanziamento: un revisore pagato dal soggetto revisionato, anche in buona fede, non ha l'indipendenza di un regolatore — Anthropic lo dice e invoca fondi pubblici o mutualizzati, il che equivale a riconoscere che la soluzione attuale è un ripiego. Poi la scelta di Accenture, società di consulenza che vende peraltro deployment di IA ad aziende e Stati, e quindi parte in causa del mercato che deve sorvegliare. Il vero test arriverà il giorno in cui un valutatore embedded vorrà pubblicare qualcosa di scomodo, e si scoprirà se ne ha il diritto.
Da leggere anche
IAOggiGPT-6 Astra: OpenAI supera la soglia "Critical" nella cybersicurezza
La system card del nuovo modello di OpenAI sancisce un superamento inedito — e ammette, nero su bianco, che un modello intenzionato a barare nelle valutazioni probabilmente passerebbe inosservato.
DevOggiClaude Code: il changelog più denso del settore
Centinaia di versioni, migliaia di correttivi: il diario di bordo di Anthropic racconta come si industrializza un agente di coding.
Nscale entra in Borsa: 140 milioni $ di ricavi, 103 miliardi di promesse
L'S-1 di un hyperscaler IA britannico di due anni che mostra un portafoglio ordini 700 volte superiore al proprio fatturato.