Editoriale di Deborah Mayo su Conservation Biology del 6 dicembre 2021 — una filosofa della statistica chiamata a dire la sua dentro il dibattito metodologico di una scienza applicata, il che è già metà dell’interesse. Il tema apparente sono i p-value; il tema reale è chi abbia titolo a fissare lo standard di prova di una disciplina. L’attrezzo che porta è il conflitto di interessi intellettuale, e la formulazione è sua: «Avere il potere di imporre una politica del genere può creare un conflitto d’interessi. A differenza di un conflitto tipico, questo è intellettuale, e può minacciare proprio gli obiettivi di integrità, riproducibilità e trasparenza che si propone.» Non si tratta di denaro, di consulenze o di azioni, e proprio per questo non compare in nessuna delle dichiarazioni che le riviste pretendono. Eppure funziona come ogni conflitto: chi decide la regola secondo cui gli altri saranno valutati ha un interesse nella regola, e se la regola coincide con la posizione che sostiene da vent’anni in una disputa aperta, imporla non è un atto tecnico. Il caso concreto è la vicenda dell’American Statistical Association, negli Stati Uniti, fra il 2016 e il 2021. La dichiarazione del 2016 si limitava a segnalare le fallacie nell’uso dei p-value ed era, scrive Mayo, «largamente non controversa». L’editoriale del 2019 di Wasserstein e colleghi va molto oltre: arriva a un passo dal raccomandare l’abbandono della dizione «statisticamente significativo» e sostiene che il superamento di una soglia «non dovrebbe essere considerato in alcun modo nell’interpretazione dei dati». Nello stesso anno un commento su Nature chiede di mandare in pensione la significatività statistica e raccoglie oltre ottocento firme — che Mayo tratta come un argumentum ad populum, non come un argomento. La disputa è finita quando la Task Force nominata dal presidente ASA ha dovuto chiarire che quell’editoriale non era politica ufficiale dell’associazione, e che «i p-value sono misure statistiche valide, che forniscono convenzioni utili per comunicare l’incertezza inerente ai risultati quantitativi». Dentro c’è la frase che vale l’ingresso da sola, perché è la logica del not even wrong detta in un altro dominio: «Ciò che la posizione senza soglie fa, se presa alla lettera, è precludere il test. Se non si può dire in anticipo di nessun risultato che non sarà ammesso a contare in favore di una tesi, allora quella tesi non la si sta testando.» L’argomento pratico che ne segue è controintuitivo e regge: togliere le soglie non riduce il data dredging, lo rende invisibile, perché il ricercatore ha comunque bisogno di un numero piccolo per sostenere un effetto, e in assenza di una soglia dichiarata nessuno può più distinguere il numero piccolo ottenuto per disciplina da quello ottenuto per insistenza. Mayo sostiene invece la preregistrazione delle ipotesi e delle regole di arresto, «uno dei modi più efficaci di promuovere la replicazione», e soglie scelte con una giustificazione teorica invece che per abitudine allo 0,05. La ragione per cui la scheda entra in archivio non è però l’esito di quella lite, ed è utile dirlo: Mayo è parte in causa, sostiene una delle due posizioni in campo, e questo editoriale è anche una mossa nella sua guerra. L’attrezzo resta valido per chiunque, compresa lei. Si applica a un comitato che sceglie i benchmark su cui sarà misurato un modello, a un’agenzia che fissa il criterio di approvazione di un farmaco, a un sistema di valutazione universitaria progettato da chi sarà valutato. La domanda non è se chi decide sia in buona fede — di norma lo è — ma se la regola che impone sia quella che difende. Nella formulazione più tagliente, che viene da un suo articolo di due anni prima sull’European Journal of Clinical Investigation: «L’argomento le soglie di significatività possono essere usate molto male, dunque togliamo le soglie è un argomento molto cattivo.»

WR

Codice attribuito retroattivamente il 23 agosto 2026, all’introduzione della notazione: è una ricostruzione dichiarata, non una registrazione in presa diretta.