Alcuni lo sono, la maggior parte no, e non è il formato a deciderlo. Uno studio del 2024 che ha somministrato il WAIS-IV a distanza ha trovato punteggi allineati ai test in presenza con correlazioni superiori a .90, quindi fare un test tramite browser non corrompe di per sé il risultato. Ciò che corrompe il risultato è come il test è stato costruito: se le domande sono state scritte da qualcuno formato in psicometria, se il punteggio è stato calibrato su un campione reale e se il sito ha un incentivo a restituirti un numero lusinghiero.

Cosa rende davvero accurato un test del QI

Tre proprietà fanno il lavoro, e nessuna è visibile dalla pagina d'ingresso.

L'affidabilità indica se il test dà un punteggio simile quando lo si rifà. Un test con scarsa affidabilità misura rumore. La validità indica se misura ciò che dichiara di misurare. Un quiz che testa soprattutto la velocità di lettura può essere perfettamente affidabile e non essere comunque un test di intelligenza. La normazione è la fase di calibrazione: i punteggi hanno un significato solo rispetto a una popolazione di riferimento, e un test mai somministrato a un campione rappresentativo non può onestamente dirti il tuo percentile.

La maggior parte dei test online gratuiti fallisce sul terzo punto. Scrivere 30 domande plausibili è facile. Stabilire come appare la distribuzione dei punteggi su migliaia di partecipanti rappresentativi è costoso, e un sito che offre il test gratis ha poche ragioni per pagarlo.

Il problema dell'inflazione dei punteggi

C'è una ragione commerciale per cui tanti test online restituiscono numeri intorno a 120 e 130. Un punteggio lusinghiero viene condiviso. Un punteggio di 103 non finisce in una chat di gruppo, e un sito che dipende dal traffico da passaparola lo impara in fretta.

L'inflazione avviene in due modi. Il test può essere troppo facile, cosicché la maggior parte dei partecipanti si concentra vicino al tetto e la scala viene allungata per far sembrare eccezionale quel gruppo. Oppure la curva di punteggio può essere semplicemente generosa, mappando il 70% di risposte corrette su 130 perché nulla lo impedisce. Nessuno dei due casi è rilevabile dall'interno del test. Il segnale è a livello di popolazione: se la distribuzione pubblicata di un test mostra la maggior parte degli utenti sopra 120, la calibrazione è sbagliata, perché per definizione solo circa il 9% delle persone lo è.

Un controllo di buon senso utile è fare due test non correlati tra loro. L'abilità cognitiva reale è stabile, quindi uno scarto di 30 punti tra due risultati significa che almeno uno dei due è mal calibrato.

Cosa misurano peggio i test online

Anche un test online costruito con cura perde ciò che una valutazione clinica coglie. Non c'è un esaminatore che osserva come affronti un problema, ed è lì che uno psicologo nota la strategia, la tolleranza alla frustrazione e se un punteggio basso riflette abilità o ansia. I sottotest a tempo che richiedono di manipolare blocchi fisici non possono essere somministrati tramite browser in alcun modo.

Le condizioni non sono controllate. Una valutazione clinica avviene in una stanza silenziosa con un somministratore formato. Un test online avviene ovunque tu fossi seduto, magari con un telefono che si illumina accanto a te. Anche quella variabilità non è rumore casuale, perché deprime sistematicamente i punteggi di chi fa il test in condizioni peggiori.

Nessuno controlla se hai cercato qualcosa. I test autosomministrati si basano interamente sul fatto che chi li fa non copi, il che va bene per curiosità personale e squalifica qualsiasi uso ufficiale.

Come leggere un punteggio da un test online

Trattalo come una stima con un margine ampio. Anche i test del QI somministrati professionalmente riportano un intervallo di confidenza, di solito intorno a più o meno cinque punti; un test online ne merita uno più ampio.

La parte più informativa di un buon risultato è la ripartizione per categoria. Un totale di 112 ti dice poco. Sapere che deriva da un forte riconoscimento di pattern e da un ragionamento verbale nettamente più debole ti dice qualcosa su cui puoi agire, e la forma di quel profilo è più stabile tra un test e l'altro rispetto al numero complessivo.

Prendi il risultato sul serio come segnale e con leggerezza come fatto. Se un test dà 95 e tu eri esausto e lo facevi da un telefono su un treno, quel numero non descrive la tua abilità. Se tre test separati fatti in condizioni ragionevoli danno tutti circa 95, questo merita attenzione.

Dove si colloca IQ SpeedRun

Vale la pena essere diretti sul nostro test. Usa gli stessi formati di item delle batterie standardizzate, cioè ragionamento a matrici, serie numeriche, analogie verbali e rotazione spaziale, e riporta il risultato sulla scala convenzionale dove 100 è il punto medio e 15 punti corrispondono a una deviazione standard. Ogni sessione estrae 25 domande da una banca di 30 item in ordine casuale, quindi rifarlo non è la stessa prova.

Non è somministrato clinicamente, non ha un campione normativo supervisionato e non può essere usato per diagnosi, collocazione scolastica o ammissione a una società ad alto QI. Lo diciamo su ogni pagina di test, non in una nota a piè di pagina. È costruito per darti una stima ragionevole e una ripartizione utile di dove si collocano i tuoi punti di forza, e va letto esattamente così.

General IQ Test

25 domande, 31 minuti, valutato appena finisci.

Fai il General IQ Test

Domande che le persone fanno anche

Un test del QI online può essere usato per il Mensa?

No. Il Mensa accetta solo test standardizzati e supervisionati dalla sua lista approvata, somministrati in condizioni controllate. Nessun test online non supervisionato è valido, incluso il nostro. Il Mensa gestisce anche un proprio test di ammissione supervisionato, che è la via consueta.

Perché ho ottenuto punteggi diversi in due test online?

Il più delle volte, una calibrazione diversa. Due test normati su campioni diversi, o non normati affatto, collocano la stessa prestazione in punti diversi della scala. Anche le differenze di contenuto contano: un test incentrato sul vocabolario favorirà una persona diversa rispetto a uno incentrato sulla rotazione spaziale.

Continua a leggere

Dr. Sarah Chen è una ricercatrice di psicologia cognitiva specializzata in valutazione dell'intelligenza e psicometria, e scrive qui di come i test vengono costruiti, valutati e interpretati male. Altre guide
← Tutte le guide Vedi tutte e nove le valutazioni →