确实有些是准确的,大多数则不然,而形式本身并不能决定这一点。一项2024年的研究通过远程方式施测WAIS-IV,发现所得分数与现场测试的相关性高于0.90,可见仅仅通过浏览器进行测试本身并不会损害结果的准确性。真正损害结果的是测试的编制方式:题目是否由受过心理测量学训练的人编写、评分标准是否依据真实样本校准,以及该网站是否有动机给你一个讨喜的高分。

究竟是什么让智商测试变得准确

起决定作用的是三个特性,而这三者在网站首页上都看不出来。

信度指的是你重新测一次时,是否能得到相近的分数。信度差的测试测量的只是噪音。效度指的是测试是否真的测量了它声称要测量的东西。一份主要在测阅读速度的题目,即便信度完美,也依然算不上智力测试。常模化是校准的关键步骤:分数只有相对于参照人群才有意义,而一个从未在具有代表性的样本上施测过的测试,是无法诚实地告诉你你的百分位的。

大多数免费在线测试都在第三点上失败。编写30道看起来合理的题目并不难。但要确定分数在成千上万名具有代表性的受测者中的分布情况,成本高昂,而一个免费提供测试的网站几乎没有理由为此买单。

分数虚高的问题

许多在线测试给出的分数都落在120到130多之间,这背后有商业原因。讨喜的高分会被人分享出去。而103分是不会被发到群聊里的,依赖转发流量的网站很快就会明白这一点。

分数虚高有两种方式。一种是测试太简单,导致大多数受测者都聚集在满分附近,量表被人为拉伸,让这种聚集看起来很出众。另一种是评分曲线过于宽松,把70%的正确率直接映射成130分,因为没有任何机制阻止这样做。这两种情况都无法从测试内部察觉。真正的破绽在人群整体层面:如果一个测试自己公布的分数分布显示大多数用户都在120以上,那么它的校准就是错的,因为按定义,只有大约9%的人能达到这一水平。

一个有用的自查方法是做两个互不相关的测试。真正的认知能力是稳定的,所以如果两次结果相差30分,就说明至少有一个测试的校准存在严重问题。

在线测试测量效果较差的方面

即使是精心设计的在线测试,也会遗漏临床评估能捕捉到的信息。没有考官在旁观察你解题的方式,而这正是心理学家借以判断解题策略、挫折承受力,以及低分究竟反映能力不足还是焦虑的关键所在。那些依赖操作实体积木的计时分测验,更是完全无法通过浏览器完成。

测试环境也不受控。临床评估在安静的房间里、由受过训练的主试进行;而在线测试则发生在你当时随便坐着的任何地方,旁边说不定还有手机不断亮屏。这种差异也并非随机噪音,因为它会系统性地拉低在较差环境下测试者的分数。

也没有人核实你是否查阅过任何资料。自我施测的测试完全依赖受测者不作弊,这对满足个人好奇心来说没问题,但用于任何正式用途则完全不合格。

如何解读在线测试的分数

把它当作一个误差范围较大的估计值来看待。即便是专业施测的智商测试,也会给出置信区间,通常在正负5分左右;在线测试理应给出更宽的区间。

一份好的结果中,更有信息量的部分是分类细目。总分112分本身透露不了太多信息。但如果知道这个分数是由较强的模式识别能力和明显偏弱的言语推理能力组成的,就能告诉你一些可以据此采取行动的信息,而且这种能力剖面在不同测试之间,比总分本身更稳定。

把结果当作一个信号来认真对待,而不要把它当作一个确凿的事实。如果测试给出95分,而你当时疲惫不堪、又是在火车上用手机做的测试,这个数字并不能真实反映你的能力。但如果在合理条件下分别做了三次不同的测试,结果都接近95分,那就值得留意了。

IQ SpeedRun处于什么位置

有必要坦率地说说我们自己的测试。它采用与标准化测验相同的题型,包括图形推理、数字序列、言语类比和空间旋转,并按照常规量表报告结果,其中100为中位数,15分为一个标准差。每次测试都从30道题的题库中随机抽取25道,因此重考的题目不会与上次相同。

它不是临床施测的,也没有经过监考的常模样本,不能用于诊断、择校分班,或加入高智商社团。这一点我们会在每个测试页面上明确说明,而不是藏在脚注里。它的设计目的是给你一个合理的估计值,以及一份有用的优势分布细目,理解为这个用途即可,不要期待更多。

General IQ Test

25道题,31分钟,完成后立即出分。

参加General IQ Test

大家还会问

在线智商测试能否用于申请门萨?

不能。门萨只接受其认可名单上、在受控条件下进行的有监考、标准化测试。任何无监考的在线测试都不符合资格,包括我们的测试在内。门萨也设有自己的监考入会测试,这是最常见的途径。

为什么我在两个在线测试上的分数不同?

多数情况下是校准不同所致。两个测试如果依据不同样本常模化,或者根本没有常模化,就会把同样的表现放在量表上不同的位置。内容差异也有影响:偏重词汇的测试和偏重空间旋转的测试,会对不同类型的人更有利。

继续阅读

Dr. Sarah Chen是一名认知心理学研究者,专注于智力测评与心理测量学,在本站撰写关于测试如何编制、评分及被误读的文章。 更多指南
← 全部指南 查看全部九项测评 →