Inchiesta di Sarah Mervosh, Francesca Paris e Claire Cain Miller, pubblicata sull’Upshot del New York Times il 28 settembre 2026. Punto di partenza: rispetto al 2015 i punteggi di lettura sono scesi nell’83% dei distretti scolastici americani, e il calo in matematica è quasi altrettanto diffuso — un declino iniziato prima della pandemia e proseguito dopo. Le autrici hanno chiesto a 37 accademici e ricercatori che studiano l’istruzione — fra cui Eric Hanushek e Sean Reardon (Stanford), Susan Dynarski (Harvard), Thomas Kane (Harvard), Douglas Harris (Tulane) — di valutare 30 interventi su una scala da 1 a 7 per impatto sull’apprendimento e per costo, assumendo in ogni caso che l’intervento fosse realizzato bene. Il sondaggio è stato condotto in agosto 2026; le autrici lo presentano come «una misura utile di come i ricercatori esperti vedono queste idee», non come sondaggio scientifico in senso stretto.

Il risultato più citabile riguarda il costo-efficacia, e attraversa lo schieramento politico senza badarci. Tre idee popolari a sinistra e a destra finiscono nel quintetto peggiore: i voucher scolastici (efficacia 2,4, costo 5,1) — la riforma bandiera conservatrice, oggi disponibile in un numero crescente di Stati, dove gran parte del denaro va a famiglie già iscritte a scuole private e l’evidenza di miglioramento accademico per chi si trasferisce è scarsa; le classi più piccole (3,8/6,5) — cara alla sinistra, ma gli esperti sono scettici che si riesca realisticamente a scendere sotto la soglia — circa 15 studenti — a cui la ricerca attribuisce il beneficio, e assumere molti più insegnanti rischia di abbassarne la qualità media; e l’aumento generalizzato degli stipendi (3,9/6,3), contro l’alternativa più mirata — pagare di più chi insegna nelle scuole più povere (4,8/4,1), che invece entra nella cinquina più efficace in assoluto.

Quello che regge, a parità di costo, è un gruppo di interventi tecnici e poco ideologici, e condividono un tratto: più rigore accademico per più studenti, non più spesa indifferenziata. La science of reading (5,3/3,2) — un approccio sistematico alla lettura centrato sulla fonetica e su pratiche validate sperimentalmente, in alternativa ai metodi “whole language” — è seconda per efficacia assoluta e prima per costo-efficacia. I curricula di alta qualità selezionati da uno Stato o da un distretto, invece che scelti scuola per scuola o insegnante per insegnante, e l’accesso esteso alle classi avanzate (algebra in terza media, corsi Advanced Placement), scelto su base di merito dichiarato e non di selezione di insegnanti o genitori, completano il gruppo.

Il caso più istruttivo è la school accountability: voti alle scuole in stile A-F e obbligo di correggere per chi è sotto soglia, secondo intervento più costo-efficace in assoluto (4,3/2,8). Il testo ne data con precisione l’ascesa e il declino: strumento centrale del No Child Left Behind, la legge federale in vigore dal 2002 al 2015, abbandonato da governo federale e da molti Stati perché percepito come punitivo e troppo dipendente dal solo punteggio standardizzato. Negli ultimi anni alcuni Stati hanno adottato un modello che guarda al progresso dello studente, non solo al livello assoluto, e offre sostegno — non solo sanzione — alle scuole sotto soglia: è questa versione, e non quella del 2002, a risultare costo-efficace.

È qui che il pezzo si aggancia a una voce già presente nell’archivio, e la completa dal lato opposto. La scheda su segregazione scolastica — la cronaca di Nikole Hannah-Jones — registra il caso in cui una misurazione viene abbandonata perché l’esito è dato per scontato, e lo definisce «il rovescio della legge di Goodhart: lì la misura si corrompe perché diventa obiettivo, qui si corrompe perché viene abbandonata». Il No Child Left Behind originale è il primo di quei due fallimenti — misurare nel modo sbagliato, fino a fare della misura stessa il bersaglio; la sua versione corretta, quella che il 2026 giudica costo-efficace, è il tentativo di evitare entrambi gli errori insieme: misurare, ma il progresso e non solo il livello, e accompagnare la misura con un intervento invece che con la sola sanzione.

Un ultimo dato, isolato e non forzato in una tesi: fra le trenta idee sottoposte al panel, «consentire l’uso dell’intelligenza artificiale» ottiene il punteggio di efficacia più basso di tutti, 2,2 su 7 — peggio di «niente laptop personali» (2,9) e di «eliminare il tracking per livello» (2,5). Il testo non argomenta il perché; lo registra come dato, in attesa di un pezzo che lo spieghi.

La conclusione del pezzo è di metodo più che di contenuto, e vale la pena di riportarla perché disinnesca la lettura a lista della spesa: nessun singolo intervento basta da solo, e il modo in cui viene eseguito conta più di quale si scelga. Citano il caso di Mississippi e Louisiana, in risalita nelle classifiche nazionali con combinazioni di più strategie fra quelle giudicate efficaci. Marguerite Roza (Georgetown): «nella pratica, fare semplicemente qualcosa bene può contare più di qualunque intervento specifico. L’esecuzione è tutto.»

WR