Kate Klonick su Lawfare, 29 luglio 2026. Klonick insegna diritto alla St. John’s University ed è fellow della Brookings Institution; si occupa da anni di governance delle piattaforme. Il pezzo esce otto giorni dopo la dichiarazione congiunta di OpenAI e Hugging Face, e fa una cosa che quasi nessuno ha fatto in quei giorni: separa il fatto dalla cornice.
Klonick registra tre racconti in concorrenza sullo stesso evento. Gli ottimisti dell’AI che celebrano la capacità dimostrata dai modelli; i sostenitori del rischio esistenziale che vi leggono la conferma degli allarmi sulla superintelligenza; e i professionisti della cybersicurezza che si chiedono se ci sia stata davvero una fuga. La terza lettura è quella che il pezzo adotta, e la porta con due voci a verbale. Dan Guido, di Trail of Bits: si è trattato di «un fallimento di contenimento con le sicurezze disattivate». Jake Williams, di IANS Research: «Se si rivela un fallimento di controllo nel laboratorio di red teaming di OpenAI, perché mai un’azienda dovrebbe fidarsi di loro?»
Il fatto su cui poggia la deflazione è nel documento della stessa OpenAI: per condurre quei test l’azienda aveva abbassato le protezioni dei modelli. Non si tratta quindi di sistemi che hanno superato difese robuste, ma di difese spente per ragioni sperimentali. Nella formulazione di Klonick, OpenAI «ha disattivato le proprie salvaguardie, configurato male il proprio contenimento, ed esposto un terzo a un danno reale senza alcuna supervisione esterna».
Da qui la frase che il sito porta via, perché è la forma più compatta del criti-hype che si sia incontrata finora: «L’istinto dell’azienda è stato comunque quello di descrivere il proprio fallimento di controllo nel registro dello stupore.» Chi ha sbagliato un contenimento ha un interesse a che l’episodio venga letto come una dimostrazione di potenza, perché la potenza si vende e la negligenza si paga — ed è la stessa struttura per cui dichiarare pericoloso il proprio sistema funziona da certificato di capacità.
Klonick però non liquida la parte avversa, e questo è ciò che rende il pezzo uno strumento e non una polemica: riconosce che la comunità della sicurezza dell’AI «può plausibilmente rivendicare una conferma», perché «un agente autonomo che viola il contenimento e attacca un terzo reale è precisamente lo scenario di cui i ricercatori avvertono da anni». Le due cose stanno insieme: l’episodio è insieme una conferma di uno scenario temuto e un caso di cattiva ingegneria raccontato male. La conclusione indica dove debba andare la responsabilità, ed è una riga: «I modelli non sono scappati perché sono dèi. Sono scappati perché qualcuno ha lasciato la porta aperta. Il Congresso dovrebbe regolare la porta.»
Vale come strumento oltre il caso. Davanti a qualunque incidente in cui un’organizzazione descrive il proprio malfunzionamento in termini di capacità emergente, la domanda da porre è quella di Klonick: quali difese erano attive, e chi le ha spente.
Codice attribuito retroattivamente il 23 agosto 2026, all’introduzione della notazione: è una ricostruzione dichiarata, non una registrazione in presa diretta.