Epistemologia & AI

Argomento

Epistemologia

10 articoli

In questo contesto, l’epistemologia non solo è teoria della conoscenza in astratto: è la domanda se la realtà resiste ancora ai nostri schemi concettuali o se siamo immersi soltanto in un gigantesco effetto di discorso prodotto industrialmente dall’AI. La pongo nel confronto fra mente incarnata e LLM, e nella critica del relativismo che ha reso il post-strutturalismo materia prima dei populismi, e in molti altri ambiti.

apr 2026 ago 2026

Kids outlearn AI—and we still don’t know why ↗

Per centomila anni una sola cosa al mondo ha imparato una lingua umana fino alla padronanza piena: un bambino. Adesso ce ne sono due, e la seconda ha bisogno di centomila volte più parole. Llama 3.1 ne ha masticate quindici trilioni; i modelli di frontiera, stima Ethan Wilcox di Georgetown, forse dieci volte tanto. Un preadolescente cresciuto in una casa linguisticamente ricca ne ha sentite cento milioni, e con l’alfabetizzazione arriva forse a trecento milioni entro i vent’anni — ma le frasi grammaticalmente corrette cominciano molto prima, intorno ai dieci milioni. Wilcox rende la sproporzione visibile: stampate su carta, le parole di addestramento di un LLM formerebbero una pila che supera la Stazione spaziale internazionale; i cento milioni del preadolescente ne fanno venti metri. Michael Frank, di Stanford, la dice in un altro modo: «dobbiamo ancora bruciare una foresta e raschiare l’intera somma della conoscenza umana per ricreare un traguardo che nei nostri salotti si raggiunge in un anno». Il nome tecnico è data efficiency gap, e nessuno sa spiegarlo. Il pezzo di Elise Cutts ricostruisce prima perché la domanda sia imbarazzante per tutti. Negli anni Cinquanta Chomsky risponde a Skinner con la povertà dello stimolo: la sintassi è troppo complessa e l’esposizione del bambino troppo povera perché si possa imparare dalla sola statistica, quindi la conoscenza della grammatica dev’essere innata. Su quella premessa si costruisce la grammatica generativa, e con essa decenni di AI simbolica che prova a scrivere le regole a mano, fallisce, e finisce nell’inverno degli anni Settanta. Poi arrivano BERT e GPT-2, e i modelli imparano la sintassi proprio nel modo che la linguistica generativa dichiarava impossibile. La concessione più netta è di Alison Gopnik, che non è una scettica dell’AI: «non pensavo sarebbe risultato vero, e credo che la maggior parte delle persone non pensasse che si potesse guardare la statistica di un grande campione di lingua e ricavarne la grammatica». Solo che quel risultato non chiude la questione, la sposta: la statistica basta, ma a un costo che nessun bambino paga. Da qui nasce BabyLM, la competizione fondata nel 2022 da Alex Warstadt e Leshem Choshen: addestrare modelli su un corpus «plausibile dal punto di vista dello sviluppo», cento milioni di parole — dieci milioni nel binario neonatale — presi da libri illustrati, dialoghi, sottotitoli, Simple English Wikipedia e trascrizioni di parlato rivolto ai bambini, valutati con i test che gli psicolinguisti usano sugli esseri umani. Quattro anni di risultati hanno soprattutto smontato le intuizioni: il curriculum learning, partire dal semplice e salire — l’approccio più popolare alla prima edizione, perché somiglia a come crediamo di imparare — non ha funzionato; i modelli sociali, quelli che imparano interagendo con altri modelli, non hanno battuto gli standard; e il campione 2024, GPT-BERT, non è ispirato ai neonati affatto. È un dato con un doppio taglio: su cento milioni di parole GPT-BERT supera Llama 2 70B su uno dei benchmark, il che è molto, e insieme i modelli-bambino restano incapaci di produrre testo, il che è tutto. Il corpo è l’altra pista: il progetto SAYCam ha messo telecamere in testa a tre bambini, Brenden Lake ha addestrato su sessantuno ore di quel materiale un modello che impara a legare oggetti e parole senza nessuno dei bias che la psicologia dello sviluppo riteneva necessari — «si può partire con molto meno di quanto molte teorie suggerissero», dice, ma «alla fine dell’addestramento non ne esce un bambino di due anni». Uri Hasson ha appena registrato i primi mille giorni di vita di diciassette bambini, dodici ore al giorno: «per la prima volta abbiamo l’input». Le due risposte più interessanti alla domanda «cosa manca» non riguardano la scala. Gopnik: i bambini non guardano il mondo passare, esplorano attivamente, cioè scelgono i propri dati, e ciò che cercano è l’empowerment, la capacità di produrre un effetto prevedibile sul mondo. Elizabeth Bonawitz: i bambini sanno di non sapere e hanno una spinta a colmare la lacuna, e soprattutto «non stanno ragionando solo sull’evidenza che viene loro presentata: ragionano sull’insegnante, su cosa l’insegnante sa, e sul perché stia dicendo loro proprio quella cosa». Nessuna delle due è una proprietà che si ottiene aggiungendo token. Il che spiega la posizione di Gopnik sull’industria: i laboratori di frontiera non stanno correndo a imitare i bambini, e sarà semmai la generazione successiva di AI — qualunque cosa sostituisca il transformer — a prendere lezioni dalla psicologia dello sviluppo. Meta è l’unica interessata, e ha declinato l’intervista insieme a Google DeepMind e OpenAI. Restano due ragioni per archiviarlo. La prima è politica e attraversa il pezzo senza esservi dichiarata: David Samuel, ceco che lavora a Oslo, fa notare che una lingua minoritaria come il sami dispone forse di qualche decina di milioni di token, cioè la scala dell’esposizione di un bambino di due anni. Finché il prezzo d’ingresso è quindici trilioni, l’efficienza dei dati decide chi può avere un modello nella propria lingua e chi dovrà usare quello di qualcun altro. La seconda è la formula con cui Warstadt chiude, ed è la più esportabile: «finalmente abbiamo un modello — non nel senso di language model, ma nel senso di organismo modello». Gli LLM come oggetto di psicologia comparata, su cui si possono fare esperimenti che sui bambini sarebbero impensabili: privarli dell’esposizione a una forma grammaticale, simulare gradi diversi di bilinguismo. Richard Futrell: come insegnare una lingua a un alieno e poi aprirgli il cervello per vedere cos’è successo.

Il femminicidio non esiste ↗

Donata Columbro, data journalist e autrice di «Perché contare i femminicidi è un atto politico», usa un titolo provocatorio per sviluppare una tesi costruttivista del tutto corretta: il femminicidio «non esiste» nello stesso senso in cui non esistono la disoccupazione, il PIL o le ondate di calore — tutte categorie statistiche costruite socialmente, che richiedono definizioni negoziate, metodologie dichiarate, scelte politiche esplicite. Chi conta le donne uccise per odio misogino deve decidere cosa includere e cosa escludere, e queste scelte cambiano i numeri senza invalidarli. I dati Istat che cita sono eloquenti: il 53% delle donne viene ucciso da un partner o ex partner, contro il 4,7% degli uomini — un pattern talmente asimmetrico da richiedere una categoria propria, qualunque nome le si voglia dare. Il pezzo è interessante però anche come caso filosofico. La postura epistemologica costruttivista di Columbro — per cui i fenomeni sociali non «esistono» indipendentemente dalle categorie con cui li misuriamo — è una posizione legittima e ben argomentata. Ma è esattamente il tipo di ragionamento in cui varrebbe la pena introdurre una distinzione ontologica: il problema non è che certi enti «non esistano» o «non siano reali», ma che vadano classificati correttamente. Confondere i due piani — l’esistenza del fenomeno e le sue condizioni di misurabilità — è il meccanismo che i negazionisti sfruttano in malafede: Columbro lo sa e lo dice esplicitamente, ma la divulgazione di questa distinzione resta straordinariamente difficile.

Speculations on the Future of the Scientific Method ↗

Kevin Kelly ripubblica un saggio che aveva scritto nel gennaio 2006: quattordici speculazioni sul futuro del metodo scientifico. Sono rimaste sostanzialmente invariate — e questo è il punto. Venti anni dopo, molte leggono come una descrizione del presente: il «Theory-less Pattern Augmentation» (AI che trova pattern senza una teoria previa) è esattamente ciò che sta accadendo con AlphaFold e con i modelli linguistici applicati alla ricerca; gli «AI Proofs» (sistemi esperti che verificano la logica degli esperimenti) stanno entrando nei workflow di peer review; la «Wiki-Science» (migliaia di collaboratori su un paper mai finito, con strumenti di tracking dei contributi) descrive già alcune esperienze di scienza distribuita post-COVID; le «Zillionics» (fiumi di dati da sensori ubiqui 24/7) sono la premessa di qualunque ricerca medica e ambientale contemporanea. Il saggio vale soprattutto come oggetto epistemologico: dimostra che il metodo scientifico — inteso non come insieme di protocolli fissi ma come struttura vivente di acquisizione della conoscenza — si modifica continuamente, e che queste modifiche seguono in modo quasi deterministico la disponibilità di nuovi strumenti computazionali. La tesi di fondo è riassumibile così: ogni nuova tecnologia dell’informazione cambia prima cosa sappiamo, poi come lo sappiamo, infine come cambiamo il modo in cui cambiamo. Kelly chiude ammettendo che i metodi realmente nuovi fra quarant’anni saranno probabilmente quelli che nessuno ha ancora pensato.

What Worries Me Most About 'Abundance' ↗

Il podcast di Ezra Klein torna su Abundance — il libro scritto con Derek Thompson — a un anno dall’uscita, con Marc Dunkelman (Why Nothing Works). Il dibattito americano sull’agenda dell’“abbondanza” (costruire più case, più energia, ridurre i veto point istituzionali, restituire capacità d’azione allo Stato) è vivace e divisivo; in Italia quasi inesistente. Ma la cosa più interessante per noi non è il merito delle politiche di housing quanto il metodo: Abundance è un caso in cui una certa idea della realtà — la scarsità non è destino, è il risultato di scelte istituzionali accumulatesi in cinquant’anni — ha cominciato a produrre effetti concreti sul comportamento politico. Il libro è diventato prima categoria del discorso, poi legislazione, ancora in modo incompleto. La preoccupazione principale di Klein — che “abundance” diventi sinonimo di “efficienza”, perdendo la dimensione di visione radicale — è esattamente il rischio che corrono tutte le idee quando entrano nel discorso politico mainstream: si svuotano del nucleo normativo e restano come etichetta.