智商100分处于第50百分位,115分大约处于第84百分位,120分处于第91百分位,130分处于第97.7百分位,145分则大约处于第99.9百分位。这些数字来自分布的形状,而不是通过实际清点受测者得出的:智商分数被定义为服从均值为100、标准差为15的正态曲线,因此每一个分数都可以通过测量它与中间值的距离,换算成一个百分位。
完整百分位对照表
百分位指的是得分达到或低于某一分数点的人口比例。一个处于第84百分位的人,得分高于每100人中的84人。
| 分数 | 百分位 | 得分更低的人群 | 稀有程度 |
|---|---|---|---|
| 145 | 第99.9百分位 | 1,000人中有999人 | 约每1,000人中有1人 |
| 140 | 第99.6百分位 | 1,000人中有996人 | 约每250人中有1人 |
| 135 | 第99百分位 | 每100人中有99人 | 约每100人中有1人 |
| 130 | 第97.7百分位 | 每100人中约有98人 | 约每44人中有1人 |
| 125 | 第95百分位 | 每100人中有95人 | 约每20人中有1人 |
| 120 | 第91百分位 | 每100人中有91人 | 约每11人中有1人 |
| 115 | 第84百分位 | 每100人中有84人 | 约每6人中有1人 |
| 110 | 第75百分位 | 每4人中有3人 | 约每4人中有1人 |
| 105 | 第63百分位 | 接近每3人中有2人 | 常见 |
| 100 | 第50百分位 | 一半 | 中位点 |
| 95 | 第37百分位 | 每3人中超过1人 | 常见 |
| 90 | 第25百分位 | 每4人中有1人 | 约每4人中有1人 |
| 85 | 第16百分位 | 每100人中有16人 | 约每6人中有1人 |
| 80 | 第9百分位 | 每100人中有9人 | 约每11人中有1人 |
| 70 | 第2百分位 | 每100人中有2人 | 约每44人中有1人 |
注意百分位在高端是如何被压缩的。从100分升到115分,能让你超越34%的人口。而从130分升到145分,同样是15分的跨度,却只能让你多超越不到2%的人。正是这种压缩效应,导致高分之间的微小差异,其实际意义远比看起来要小。
这些数字从何而来
智商是一个标准化后的分数,而不是答对题数的简单计数。原始表现会被转换,使人口平均值落在100分,一个标准差等于15分。其余一切都是正态分布性质的自然推论。
这就得出了我们熟悉的区间:大约68%的人落在均值的一个标准差范围内,也就是85到115分之间。大约95%的人落在两个标准差范围内,也就是70到130分之间。大约99.7%的人落在三个标准差范围内,也就是55到145分之间。
这带来一个常常让人措手不及的后果。由于这个量表是相对于某个参照人群来定义的,一个分数只有相对于测试所依据的常模群体才有意义。一个以大学生为常模的测试,会把同一个人的分数评得比以普通成年人群体为常模的测试更低,而这两个结果都没有错。
为什么有些测试使用16或24作为标准差
并非每个测试都使用15作为标准差。斯坦福-比奈量表历史上曾使用16,而卡特尔III B量表则使用24。这些选择会让同一个数字所代表的含义发生相当大的变化。
斯坦福-比奈量表上132分,对应第98百分位。而在卡特尔量表上要达到第98百分位,则需要148分。这两个分数描述的是同一个人。这就是为什么高智商社团会为每个测试分别公布不同的门槛,而不是给出一个统一数字,也是为什么在不知道所用量表的情况下比较不同测试的分数是没有意义的。
任何一个未注明所用量表的分数,都应默认其标准差为15,这是现代通行的惯例,韦氏系列测试用的也是这一标准。
百分位无法告诉你的事
排名是精确的,但背后的测量本身并不精确。一份专业施测的测试会给出一个置信区间,通常是分数两侧各约5分,所以一个报告为118分的结果,实际上是在说真实分数很可能落在113到123分之间。而这个区间跨越了第81到第94百分位。
百分位还会抹平能力剖面上的差异。两个同样处于第91百分位的人,认知能力的构成可能完全不同,一个主要靠言语能力撑起分数,另一个则主要靠空间推理。就实际用途而言,分测验的模式比单一排名更有价值。
而且排名本身对结果没有任何说明力。认知能力对工作表现和学业成绩有中等程度的预测力,而且任务越复杂,预测力越强,但在解释一个人最终会走到哪一步时,它还要与尽责性、机遇和健康状况相互竞争。
大家还会问
智商130分对应第几百分位?
在标准量表(一个标准差为15分)上是第97.7百分位。这意味着大约有2.3%的人得分达到或超过130分,也就是大约每44人中有1人。这是划分“天赋”等级的常规门槛。
第50百分位算是一个差成绩吗?
它正好处于量表的正中间,按定义,这个区域涵盖的人数比量表上任何其他区域都多。有一半人口的得分低于它。把“中等”当作一种不足,是对这个量表用途的误读,因为这个量表本来就是被设计成让大多数人落在中间附近的。