برخی دقیقاند، بیشترشان نه، و این فرمت نیست که تعیینکننده است. پژوهشی در سال 2024 که آزمون WAIS-IV را از راه دور اجرا کرد، نمراتی یافت که با آزمون حضوری در همبستگیهای بالای .90 مطابقت داشت، پس گرفتن آزمون از طریق مرورگر بهخودیخود نتیجه را خراب نمیکند. آنچه نتیجه را خراب میکند نحوه ساخت آزمون است: آیا سؤالات را کسی آموزشدیده در روانسنجی نوشته، آیا نمرهدهی در برابر یک نمونه واقعی کالیبره شده، و آیا سایت انگیزهای برای دادن عددی چاپلوسانه به شما دارد.
چه چیزی واقعاً یک آزمون هوش را دقیق میکند
سه ویژگی کار اصلی را انجام میدهند و هیچکدام از صفحه فرود قابل مشاهده نیستند.
پایایی یعنی آزمون در تکرار نمرهای مشابه به شما بدهد. آزمونی با پایایی ضعیف نویز را اندازه میگیرد. روایی یعنی آزمون همان چیزی را بسنجد که ادعا میکند. آزمونی که عمدتاً سرعت خواندن را میسنجد میتواند کاملاً پایا باشد و همچنان آزمون هوش نباشد. هنجاریابی مرحله کالیبراسیون است: نمرات فقط نسبت به یک جمعیت مرجع معنا دارند، و آزمونی که هرگز روی نمونهای نماینده اجرا نشده نمیتواند صادقانه صدک شما را بگوید.
بیشتر آزمونهای رایگان آنلاین در مورد سوم شکست میخورند. نوشتن 30 سؤال قابلقبول آسان است. اما تعیین شکل توزیع نمرات در میان هزاران آزموندهنده نماینده پرهزینه است، و سایتی که آزمون را رایگان میدهد انگیزه چندانی برای پرداخت آن هزینه ندارد.
مسئله تورم نمره
دلیلی تجاری وجود دارد که چرا آزمونهای آنلاین بسیاری اعدادی در دهههای 120 و 130 برمیگردانند. نمرهای چاپلوسانه به اشتراک گذاشته میشود. نمره 103 در گروه چت منتشر نمیشود، و سایتی که به ترافیک ارجاعی وابسته است این را زود یاد میگیرد.
تورم به دو شکل رخ میدهد. آزمون میتواند خیلی آسان باشد، چنانکه بیشتر آزموندهندگان نزدیک سقف جمع شوند و مقیاس کشیده شود تا این خوشه استثنایی به نظر برسد. یا منحنی نمرهدهی میتواند بهسادگی سخاوتمندانه باشد و 70 درصد پاسخ درست را به 130 تبدیل کند چون چیزی مانع آن نیست. هیچکدام از داخل آزمون قابل تشخیص نیست. نشانه در سطح جمعیت است: اگر توزیع منتشرشده یک آزمون نشان دهد بیشتر کاربران بالای 120 هستند، کالیبراسیون اشتباه است، چون طبق تعریف تنها حدود 9 درصد از مردم چنیناند.
یک بررسی منطقی مفید این است که دو آزمون بیارتباط را انجام دهید. توانایی شناختی واقعی پایدار است، پس فاصله 30 نمرهای بین دو نتیجه یعنی دستکم یکی از آنها بد کالیبره شده است.
چه چیزی را آزمونهای آنلاین کمتر خوب میسنجند
حتی آزمون آنلاینی که با دقت ساخته شده چیزهایی را از دست میدهد که یک ارزیابی بالینی ثبت میکند. هیچ ممتحنی وجود ندارد که ببیند شما چگونه به مسئله نزدیک میشوید، و از همانجاست که یک روانشناس به راهبرد، تحمل ناکامی، و اینکه آیا نمره پایین بازتاب توانایی است یا اضطراب پی میبرد. زیرآزمونهای زماندار که به دستکاری مکعبهای فیزیکی نیاز دارند اصلاً از طریق مرورگر قابل ارائه نیستند.
شرایط کنترلنشده است. ارزیابی بالینی در اتاقی ساکت با یک مجری آموزشدیده انجام میشود. آزمون آنلاین هرجایی که نشستهاید انجام میشود، شاید با گوشیای که کنار شما روشن میشود. این تفاوت هم نویز تصادفی نیست، چون بهطور نظاممند نمرات کسانی را که در شرایط بدتری آزمون میدهند کاهش میدهد.
هیچکس بررسی نمیکند که آیا چیزی را جستوجو کردهاید. آزمونهای خوداجراشونده کاملاً به تقلبنکردن آزموندهنده متکیاند، که برای کنجکاوی شخصی خوب است و برای هر استفاده رسمی فاقد اعتبار.
چگونه نمره یک آزمون آنلاین را بخوانیم
آن را برآوردی با حاشیهای وسیع در نظر بگیرید. حتی آزمونهای هوشی که بهصورت حرفهای اجرا میشوند بازه اطمینانی گزارش میکنند، معمولاً حدود پنج نمره به هر طرف؛ آزمون آنلاین حاشیهای وسیعتر را شایسته است.
بخش آموزندهتر یک نتیجه خوب تفکیک دستهبندیهاست. مجموع 112 چیز چندانی به شما نمیگوید. اما دانستن اینکه از تشخیص الگوی قوی و استدلال کلامی بهطور محسوسی ضعیفتر آمده چیزی به شما میگوید که میتوانید بر اساس آن عمل کنید، و شکل این نیمرخ در آزمونهای مختلف پایدارتر از عدد اصلی است.
نتیجه را جدی بهعنوان یک نشانه بگیرید و سبک بهعنوان یک واقعیت. اگر آزمونی 95 بگوید و شما خسته بودهاید و آن را در قطار با گوشی انجام دادهاید، آن عدد توانایی شما را توصیف نمیکند. اگر سه آزمون جداگانه در شرایط معقول همگی حدود 95 نشان دهند، آن ارزش توجه دارد.
جایگاه IQ SpeedRun کجاست
درباره آزمون خودمان صریحبودن ارزشش را دارد. این آزمون از قالبهای سؤالی استفاده میکند که مجموعههای استاندارد به کار میبرند، یعنی استدلال ماتریسی، سریهای عددی، قیاسهای کلامی، و چرخش فضایی، و نتیجه را روی مقیاس متعارفی گزارش میکند که در آن 100 نقطه میانی و 15 نمره برابر با یک انحراف معیار است. هر جلسه 25 سؤال را از بانکی با 30 سؤال به ترتیب تصادفی میکشد، پس تکرار آزمون همان برگه نیست.
این آزمون بهصورت بالینی اجرا نمیشود، نمونه هنجاریابی نظارتشدهای ندارد، و نمیتوان از آن برای تشخیص، جایگذاری مدرسهای، یا ورود به یک انجمن هوش بالا استفاده کرد. ما این را در هر صفحه آزمون میگوییم، نه در یک پانویس. این آزمون طراحی شده تا برآوردی معقول و تفکیکی مفید از جایگاه نقاط قوت شما بدهد، و باید دقیقاً همینطور خوانده شود.
سؤالاتی که مردم هم میپرسند
آیا میتوان از یک آزمون هوش آنلاین برای Mensa استفاده کرد؟
خیر. Mensa فقط آزمونهای استاندارد و نظارتشده از فهرست تأییدشده خود را میپذیرد که در شرایط کنترلشده اجرا شوند. هیچ آزمون آنلاین بدون نظارتی واجد شرایط نیست، از جمله آزمون ما. Mensa همچنین آزمون پذیرش نظارتشده خودش را برگزار میکند که مسیر معمول است.
چرا در دو آزمون آنلاین نمره متفاوتی گرفتم؟
بیشتر اوقات، کالیبراسیون متفاوت است. دو آزمون که بر پایه نمونههای متفاوت هنجاریابی شدهاند، یا اصلاً هنجاریابی نشدهاند، همان عملکرد را در نقاط متفاوتی از مقیاس قرار میدهند. تفاوت محتوا هم مهم است: آزمونی که بار سنگینی روی واژگان دارد فرد متفاوتی را نسبت به آزمونی با بار سنگین چرخش فضایی مطلوب میکند.