Nogle er, de fleste er ikke, og det er ikke formatet, der afgør det. Et studie fra 2024, der administrerede WAIS-IV på afstand, fandt scorer, der stemte overens med personlig testning med korrelationer over 0,90, så det at tage en test via en browser forringer ikke i sig selv resultatet. Det, der forringer resultatet, er, hvordan testen blev konstrueret: om spørgsmålene blev skrevet af nogen uddannet i psykometri, om scoringen blev kalibreret mod en reel stikprøve, og om siden har noget incitament til at give dig et smigrende tal.

Hvad der faktisk gør en IQ-test præcis

Tre egenskaber gør arbejdet, og ingen af dem er synlige fra landingssiden.

Reliabilitet handler om, hvorvidt testen giver dig en lignende score, når du tager den igen. En test med dårlig reliabilitet måler støj. Validitet handler om, hvorvidt den måler det, den hævder at måle. En quiz, der mest tester læsehastighed, kan være fuldstændig reliabel og alligevel ikke være en intelligenstest. Normering er kalibreringstrinnet: scorer betyder kun noget i forhold til en referencepopulation, og en test, der aldrig er blevet administreret til en repræsentativ stikprøve, kan ikke ærligt fortælle dig din percentil.

De fleste gratis onlinetest fejler på det tredje. At skrive 30 plausible spørgsmål er let. At fastlægge, hvordan scorefordelingen ser ud på tværs af tusindvis af repræsentative testtagere, er dyrt, og en side, der giver testen væk gratis, har ringe grund til at betale for det.

Problemet med scoreinflation

Der er en kommerciel grund til, at så mange onlinetest returnerer tal i 120'erne og 130'erne. En smigrende score bliver delt. En score på 103 bliver ikke postet i en gruppechat, og en side, der er afhængig af henvisningstrafik, lærer dette hurtigt.

Inflation sker på to måder. Testen kan være for let, så de fleste testtagere klumper sig sammen nær loftet, og skalaen strækkes for at få klumpen til at se exceptionel ud. Eller scoringskurven kan simpelthen være generøs og omsætte 70% rigtige til 130, fordi intet forhindrer det. Ingen af delene kan opdages inde fra testen. Kendetegnet er på populationsniveau: hvis en tests egen offentliggjorte fordeling viser, at de fleste brugere ligger over 120, er kalibreringen forkert, fordi kun omkring 9% af mennesker per definition gør det.

Et nyttigt sanitetstjek er at tage to urelaterede test. Ægte kognitiv evne er stabil, så en forskel på 30 point mellem to resultater betyder, at mindst ét af dem er dårligt kalibreret.

Hvad onlinetest måler dårligere

Selv en omhyggeligt konstrueret onlinetest mister ting, som en klinisk vurdering fanger. Der er ingen eksaminator, der observerer, hvordan du griber et problem an, hvilket er der, hvor en psykolog opfanger strategi, frustrationstolerance, og om en lav score afspejler evne eller angst. Tidsbegrænsede deltest, der afhænger af at manipulere fysiske klodser, kan slet ikke gennemføres via en browser.

Forholdene er ukontrollerede. En klinisk vurdering foregår i et roligt rum med en uddannet testleder. En onlinetest foregår, hvor end du sad, måske med en telefon der lyser op ved siden af dig. Den variation er heller ikke tilfældig støj, da den systematisk sænker scorer for personer, der testes under dårligere forhold.

Ingen tjekker, om du har slået noget op. Selvadministrerede test er fuldstændig afhængige af, at testtageren ikke snyder, hvilket er fint til personlig nysgerrighed og diskvalificerende for enhver officiel brug.

Sådan læser du en score fra en onlinetest

Betragt det som et estimat med en bred margin. Selv professionelt administrerede IQ-test angiver et konfidensinterval, normalt omkring plus eller minus fem point; en onlinetest fortjener et bredere.

Den mere informative del af et godt resultat er kategoriopdelingen. En total på 112 fortæller dig lidt. At vide, at den kom fra stærk mønstergenkendelse og mærkbart svagere verbal ræsonnering, fortæller dig noget, du kan handle på, og formen af den profil er mere stabil på tværs af test end den samlede score.

Tag resultatet alvorligt som et signal og let som en kendsgerning. Hvis en test viser 95, og du var udmattet og tog den på en telefon i et tog, beskriver tallet ikke din evne. Hvis tre separate test taget under rimelige forhold alle lander tæt på 95, er det værd at bemærke.

Hvor IQ SpeedRun placerer sig

Værd at være ligefrem om vores egen test. Den bruger de samme opgaveformater som standardiserede batterier, nemlig matriceresonnement, talrækker, verbale analogier og rumlig rotation, og den rapporteres på den konventionelle skala, hvor 100 er midtpunktet og 15 point er én standardafvigelse. Hver session trækker 25 spørgsmål fra en bank på 30 spørgsmål i tilfældig rækkefølge, så en gentagelse ikke er det samme sæt.

Den administreres ikke klinisk, den har ingen overvåget normstikprøve, og den kan ikke bruges til diagnose, skoleplacering eller optagelse i et høj-IQ-selskab. Vi siger dette på hver testside snarere end i en fodnote. Den er bygget til at give dig et rimeligt estimat og en nyttig opdeling af, hvor dine styrker ligger, og den bør læses som præcis det.

General IQ Test

25 spørgsmål, 31 minutter, scores så snart du er færdig.

Tag General IQ Test

Spørgsmål folk også stiller

Kan en online-IQ-test bruges til Mensa?

Nej. Mensa accepterer kun overvågede, standardiserede test fra sin godkendte liste, gennemført under kontrollerede forhold. Ingen uovervåget onlinetest kvalificerer, heller ikke vores. Mensa afholder også sin egen overvågede optagelsestest, hvilket er den sædvanlige vej.

Hvorfor fik jeg forskellige resultater på to onlinetest?

Oftest forskellig kalibrering. To test, der er normeret mod forskellige stikprøver, eller slet ikke normeret, vil placere samme præstation på forskellige punkter på skalaen. Indholdsforskelle spiller også en rolle: en test, der vægter ordforråd tungt, vil favorisere en anden person end en, der vægter rumlig rotation tungt.

Bliv ved med at læse

Dr. Sarah Chen er forsker i kognitiv psykologi med fokus på intelligensvurdering og psykometri, og skriver her om, hvordan test konstrueres, scores og fejltolkes. Flere guides
← Alle guides Se alle ni vurderinger →