Certains le sont, la plupart ne le sont pas, et ce n'est pas le format qui en décide. Une étude de 2024 ayant fait passer le WAIS-IV à distance a trouvé des scores concordant avec la passation en présentiel à des corrélations supérieures à .90 : passer un test via un navigateur ne corrompt donc pas le résultat en soi. Ce qui corrompt le résultat, c'est la façon dont le test a été construit : les questions ont-elles été écrites par quelqu'un formé à la psychométrie, la notation a-t-elle été étalonnée sur un véritable échantillon, et le site a-t-il un intérêt à vous donner un chiffre flatteur.
Ce qui rend un test de QI réellement fiable
Trois propriétés font le travail, et aucune n'est visible depuis la page d'accueil.
La fidélité désigne le fait que le test donne un score similaire si on le repasse. Un test à faible fidélité mesure du bruit. La validité désigne le fait qu'il mesure bien ce qu'il prétend mesurer. Un questionnaire qui teste surtout la vitesse de lecture peut être parfaitement fidèle sans être un test d'intelligence. L'étalonnage est l'étape de calibration : les scores ne signifient quelque chose que par rapport à une population de référence, et un test qui n'a jamais été administré à un échantillon représentatif ne peut honnêtement pas vous indiquer votre centile.
La plupart des tests gratuits en ligne échouent sur le troisième point. Écrire 30 questions plausibles est facile. Établir à quoi ressemble la distribution des scores sur des milliers de participants représentatifs coûte cher, et un site qui offre le test gratuitement a peu de raisons de payer pour cela.
Le problème de l'inflation des scores
Il existe une raison commerciale pour laquelle tant de tests en ligne renvoient des chiffres dans les 120 et 130. Un score flatteur se partage. Un score de 103 ne se poste pas dans une conversation de groupe, et un site qui dépend du trafic de recommandation l'apprend vite.
L'inflation se produit de deux façons. Le test peut être trop facile, si bien que la plupart des participants se regroupent près du plafond et que l'échelle est étirée pour faire paraître ce regroupement exceptionnel. Ou la courbe de notation peut simplement être généreuse, faisant correspondre 70 % de bonnes réponses à 130 parce que rien ne l'en empêche. Aucun des deux n'est détectable depuis l'intérieur du test. L'indice se voit au niveau de la population : si la distribution publiée d'un test montre que la plupart des utilisateurs dépassent 120, l'étalonnage est faux, car par définition seuls environ 9 % des gens le font.
Un contrôle utile consiste à passer deux tests indépendants. La capacité cognitive réelle est stable, donc un écart de 30 points entre deux résultats signifie qu'au moins l'un des deux est mal étalonné.
Ce que les tests en ligne mesurent moins bien
Même un test en ligne soigneusement construit perd des éléments qu'une évaluation clinique capture. Il n'y a pas d'examinateur pour observer comment vous abordez un problème, ce qui est là où un psychologue repère la stratégie, la tolérance à la frustration, et si un score bas reflète une capacité ou de l'anxiété. Les sous-tests chronométrés qui reposent sur la manipulation de blocs physiques ne peuvent tout simplement pas être administrés via un navigateur.
Les conditions ne sont pas contrôlées. Une évaluation clinique se déroule dans une pièce calme avec un administrateur formé. Un test en ligne se déroule là où vous étiez assis, peut-être avec un téléphone qui s'allume à côté. Cette variance n'est pas non plus du bruit aléatoire, puisqu'elle abaisse systématiquement les scores des personnes qui testent dans de moins bonnes conditions.
Personne ne vérifie si vous avez cherché quoi que ce soit. Les tests auto-administrés reposent entièrement sur le fait que la personne ne triche pas, ce qui est très bien pour la curiosité personnelle et disqualifiant pour tout usage officiel.
Comment lire le score d'un test en ligne
Traitez-le comme une estimation avec une large marge. Même les tests de QI administrés de façon professionnelle indiquent un intervalle de confiance, généralement d'environ plus ou moins cinq points ; un test en ligne en mérite un plus large.
La partie la plus informative d'un bon résultat est la répartition par catégorie. Un total de 112 vous en dit peu. Savoir qu'il provient d'un raisonnement par les motifs solide et d'un raisonnement verbal nettement plus faible vous dit quelque chose d'exploitable, et la forme de ce profil est plus stable d'un test à l'autre que le chiffre global.
Prenez le résultat au sérieux comme signal et avec légèreté comme fait. Si un test indique 95 et que vous étiez épuisé et l'avez passé sur un téléphone dans un train, le chiffre ne décrit pas votre capacité. Si trois tests distincts passés dans des conditions raisonnables se situent tous près de 95, cela mérite votre attention.
Où se situe IQ SpeedRun
Il vaut la peine d'être direct sur notre propre test. Il utilise les formats d'items des batteries standardisées, à savoir le raisonnement matriciel, les séries numériques, les analogies verbales et la rotation spatiale, et il rapporte sur l'échelle conventionnelle où 100 est le point médian et 15 points représentent un écart type. Chaque session tire 25 questions d'une banque de 30 dans un ordre aléatoire, si bien qu'une nouvelle tentative n'est pas la même épreuve.
Il n'est pas administré cliniquement, n'a pas d'échantillon normatif supervisé, et ne peut pas être utilisé pour un diagnostic, un placement scolaire, ou l'entrée dans une société à haut QI. Nous le disons sur chaque page de test plutôt qu'en note de bas de page. Il est conçu pour vous donner une estimation raisonnable et une répartition utile de vos points forts, et il doit être lu exactement comme cela.
D'autres questions posées
Un test de QI en ligne peut-il être utilisé pour Mensa ?
Non. Mensa n'accepte que des tests standardisés et supervisés issus de sa liste approuvée, administrés dans des conditions contrôlées. Aucun test en ligne non supervisé ne qualifie, y compris le nôtre. Mensa organise aussi son propre test d'admission supervisé, qui est la voie habituelle.
Pourquoi ai-je obtenu des scores différents à deux tests en ligne ?
Le plus souvent, un étalonnage différent. Deux tests étalonnés sur des échantillons différents, ou pas étalonnés du tout, placent la même performance à des points différents de l'échelle. Les différences de contenu comptent aussi : un test à forte composante lexicale favorise une personne différente d'un test à forte composante de rotation spatiale.
Continuer la lecture
- Tableau des centiles de QI : ce que votre score signifie vraimentLe tableau complet de 70 à 145, et comment les centiles sont calculés.
- Comment se préparer à un test de QILa familiarité avec le format, le sommeil, et les tactiques qui ne servent à rien.
- Quel score de QI faut-il pour Mensa ?Top 2 %, et pourquoi le chiffre requis diffère selon le test.