Vissa är det, de flesta är det inte, och det är inte formatet som avgör saken. En studie från 2024 som administrerade WAIS-IV på distans fann poäng som stämde överens med testning på plats med korrelationer över 0,90, så att göra ett test via en webbläsare försämrar inte i sig resultatet. Det som försämrar resultatet är hur testet konstruerades: om frågorna skrevs av någon utbildad i psykometri, om poängsättningen kalibrerades mot ett verkligt urval, och om webbplatsen har något incitament att ge dig en smickrande siffra.

Vad som faktiskt gör ett IQ-test tillförlitligt

Tre egenskaper gör jobbet, och ingen av dem syns på landningssidan.

Reliabilitet handlar om huruvida testet ger dig en liknande poäng när du gör det igen. Ett test med dålig reliabilitet mäter brus. Validitet handlar om huruvida det mäter det det påstår sig mäta. Ett quiz som mest testar läshastighet kan vara helt reliabelt och ändå inte vara ett intelligenstest. Normering är kalibreringssteget: poäng betyder bara något i förhållande till en referenspopulation, och ett test som aldrig har administrerats till ett representativt urval kan inte ärligt tala om din percentil.

De flesta gratis onlinetest misslyckas med det tredje. Att skriva 30 rimliga frågor är enkelt. Att fastställa hur poängfördelningen ser ut bland tusentals representativa testdeltagare är dyrt, och en webbplats som ger bort testet gratis har liten anledning att betala för det.

Problemet med poänginflation

Det finns ett kommersiellt skäl till att så många onlinetest ger siffror i 120- och 130-intervallet. En smickrande poäng delas. En poäng på 103 hamnar inte i en gruppchatt, och en webbplats som är beroende av hänvisningstrafik lär sig detta snabbt.

Inflation sker på två sätt. Testet kan vara för lätt, så att de flesta testtagare klumpar ihop sig nära taket och skalan sträcks ut för att få klumpen att se exceptionell ut. Eller så kan poängkurvan helt enkelt vara generös och översätta 70% rätt till 130, eftersom inget hindrar det. Ingetdera går att upptäcka inifrån testet. Avslöjandet sker på populationsnivå: om ett tests egen publicerade fördelning visar att de flesta användare ligger över 120, är kalibreringen fel, eftersom per definition bara omkring 9% av människor gör det.

En användbar kontroll är att göra två orelaterade test. Genuin kognitiv förmåga är stabil, så en skillnad på 30 poäng mellan två resultat betyder att minst ett av dem är dåligt kalibrerat.

Vad onlinetest mäter sämre

Även ett noggrant konstruerat onlinetest förlorar sådant som en klinisk bedömning fångar upp. Det finns ingen testledare som observerar hur du angriper ett problem, vilket är där en psykolog upptäcker strategi, frustrationstolerans och om en låg poäng återspeglar förmåga eller ångest. Tidsbegränsade deltest som bygger på att hantera fysiska klossar kan inte alls genomföras via en webbläsare.

Förhållandena är okontrollerade. En klinisk bedömning sker i ett tyst rum med en utbildad testledare. Ett onlinetest sker var du än råkade sitta, kanske med en telefon som lyser upp bredvid dig. Den variationen är inte heller slumpmässigt brus, eftersom den systematiskt sänker poängen för personer som testar under sämre förhållanden.

Ingen kontrollerar om du har slagit upp något. Självadministrerade test förlitar sig helt på att testtagaren inte fuskar, vilket är helt okej för personlig nyfikenhet men diskvalificerande för all officiell användning.

Så tolkar du en poäng från ett onlinetest

Betrakta det som en uppskattning med bred marginal. Även professionellt administrerade IQ-test anger ett konfidensintervall, vanligtvis omkring plus eller minus fem poäng; ett onlinetest förtjänar ett bredare.

Den mer informativa delen av ett bra resultat är kategoriuppdelningen. En totalsumma på 112 säger dig lite. Att veta att den kom från stark mönsterigenkänning och märkbart svagare verbalt resonemang säger dig något du kan agera på, och formen på den profilen är mer stabil mellan test än den övergripande siffran.

Ta resultatet på allvar som en signal och lätt som ett faktum. Om ett test visar 95 och du var utmattad och gjorde det på en telefon på ett tåg, beskriver siffran inte din förmåga. Om tre separata test som gjorts under rimliga förhållanden alla hamnar nära 95, är det värt att uppmärksamma.

Var IQ SpeedRun står

Värt att vara rakt på sak om vårt eget test. Det använder samma frågeformat som standardiserade batterier, alltså matrisresonemang, talserier, verbala analogier och spatial rotation, och det redovisas på den konventionella skalan där 100 är mittpunkten och 15 poäng är en standardavvikelse. Varje session hämtar 25 frågor från en bank på 30 frågor i slumpmässig ordning, så ett omtest är inte samma prov.

Det administreras inte kliniskt, det har inget övervakat normurval, och det kan inte användas för diagnos, skolplacering eller inträde i ett höga-IQ-sällskap. Vi säger detta på varje testsida snarare än i en fotnot. Det är byggt för att ge dig en rimlig uppskattning och en användbar uppdelning av var dina styrkor finns, och det ska läsas som precis det.

General IQ Test

25 frågor, 31 minuter, poängsätts så snart du är klar.

Gör General IQ Test

Frågor folk också ställer

Kan ett online-IQ-test användas för Mensa?

Nej. Mensa accepterar endast övervakade, standardiserade test från sin godkända lista, genomförda under kontrollerade förhållanden. Inget oövervakat onlinetest kvalificerar, inte heller vårt. Mensa genomför även ett eget övervakat antagningstest, vilket är den vanliga vägen.

Varför fick jag olika resultat på två onlinetest?

Oftast olika kalibrering. Två test som normerats mot olika urval, eller inte normerats alls, placerar samma prestation på olika punkter på skalan. Innehållsskillnader spelar också roll: ett test som domineras av ordförråd gynnar en annan person än ett som domineras av spatial rotation.

Fortsätt läsa

Dr. Sarah Chen är forskare inom kognitiv psykologi med fokus på intelligensbedömning och psykometri, och skriver här om hur test konstrueras, poängsätts och feltolkas. Fler guider
← Alla guider Se alla nio bedömningar →