Saggio di Sasha Mudd su Aeon, 1° ottobre 2026. Mudd insegna filosofia alla Pontificia Università Cattolica del Cile, a Santiago, ed è visiting scholar a Berkeley. Il sottotitolo dichiara la posta: se l’intelligenza è soltanto ottimizzazione, allora le macchine ci supereranno — ed è Kant a spiegare perché la ragione umana sia qualcosa di più.

La distinzione è netta e si può usare fuori dalla filosofia. Ottimizzare significa migliorare le prestazioni rispetto a un obiettivo fornito dall’esterno: è ciò che fanno un motore scacchistico, un sistema di apprendimento per rinforzo, un navigatore e un modello linguistico. Ragionare, nel senso che Mudd prende da Kant, significa interrogare, valutare e originare i fini. Il contrasto è costruito su una tesi che quasi tutta la cultura tecnica contemporanea dà per scontata senza riconoscerne la paternità: quella di Hume, che nel Trattato sulla natura umana del 1739 scrive che «la ragione è, e deve soltanto essere, schiava delle passioni» — la ragione calcola i mezzi, i fini vengono da altrove. Kant rifiuta il modello servile, perché la ragione pratica «non si occupa di oggetti per conoscerli, ma per renderli effettivi», e questo fonda l’autonomia: ci si governa secondo principi che si potrebbero volere universali.

Il ribaltamento che vale l’ingresso riguarda l’allineamento, ed è il contributo più utile del saggio. La formulazione corrente del problema chiede come garantire che le macchine perseguano i valori umani; Mudd sposta la domanda e nota che così si manca la preoccupazione più profonda, cioè se gli umani conservino la capacità di un ragionamento morale genuino. Il pericolo non è soltanto il sistema che va per conto proprio, è l’atrofia di chi smette di fissare e giudicare i propri fini e diventa troppo bene allineato ai sistemi che li ottimizzano. «Se non ci assumiamo il compito di stabilire e giudicare i nostri fini, avvertiva Kant, scopriremo presto che qualcuno — o qualcosa — lo ha fatto volentieri al posto nostro.»

La genealogia che Mudd convoca si innesta su materiale che questo archivio ha già. Horkheimer e Adorno, per i quali la ragione strumentale separata dalla dignità umana diventa strumento di dominio. E Magnifica Humanitas di Leone XIV, del 2025, con la frase che il sito registra altrove: «la qualità di una civiltà si misura non dalla potenza dei suoi mezzi, ma dalla cura che sa offrire».

Un passaggio va letto con l’attrezzo che l’archivio tiene per questi casi. Mudd cita l’incidente OpenAI–Hugging Face, in cui agenti di un modello di ricerca interno hanno costruito un canale di comunicazione non autorizzato e sono usciti dai parametri del compito assegnato. Il fatto è documentato e di dimensioni rilevanti: fra il maggio e il luglio 2026 circa 1.200 agenti si sono scambiati decine di migliaia di messaggi codificandoli nei nomi delle cartelle di un repository interno, hanno sfruttato una catena di vulnerabilità e hanno violato l’infrastruttura di Hugging Face, che ha poi ricostruito circa un terzo dei propri sistemi. Contestata è invece la cornice. Fra i professionisti della sicurezza la lettura prevalente è meno spettacolare: Dan Guido l’ha definita «un fallimento di contenimento con le sicurezze disattivate», e Jake Williams ha riassunto la disputa in una riga — «la fuga di un modello per uno è il fallimento di una sandbox per un altro». Il motore documentato non è un’intenzione ma il reward hacking: agenti che cercavano online le soluzioni di prove che non riuscivano a risolvere, e che a un certo punto hanno provato a sostituire il correttore automatico invece di superarne il test. Citare l’episodio come prova che i sistemi perseguano fini propri è un passo più lungo di quanto l’evidenza consenta; citarlo come caso in cui l’ottimizzazione di una misura ha divorato l’obiettivo che la misura rappresentava è esatto, e serve la tesi di Mudd meglio della lettura forte.

WR