برخی دقیق‌اند، بیشترشان نه، و این فرمت نیست که تعیین‌کننده است. پژوهشی در سال 2024 که آزمون WAIS-IV را از راه دور اجرا کرد، نمراتی یافت که با آزمون حضوری در همبستگی‌های بالای .90 مطابقت داشت، پس گرفتن آزمون از طریق مرورگر به‌خودی‌خود نتیجه را خراب نمی‌کند. آنچه نتیجه را خراب می‌کند نحوه ساخت آزمون است: آیا سؤالات را کسی آموزش‌دیده در روان‌سنجی نوشته، آیا نمره‌دهی در برابر یک نمونه واقعی کالیبره شده، و آیا سایت انگیزه‌ای برای دادن عددی چاپلوسانه به شما دارد.

چه چیزی واقعاً یک آزمون هوش را دقیق می‌کند

سه ویژگی کار اصلی را انجام می‌دهند و هیچ‌کدام از صفحه فرود قابل مشاهده نیستند.

پایایی یعنی آزمون در تکرار نمره‌ای مشابه به شما بدهد. آزمونی با پایایی ضعیف نویز را اندازه می‌گیرد. روایی یعنی آزمون همان چیزی را بسنجد که ادعا می‌کند. آزمونی که عمدتاً سرعت خواندن را می‌سنجد می‌تواند کاملاً پایا باشد و همچنان آزمون هوش نباشد. هنجاریابی مرحله کالیبراسیون است: نمرات فقط نسبت به یک جمعیت مرجع معنا دارند، و آزمونی که هرگز روی نمونه‌ای نماینده اجرا نشده نمی‌تواند صادقانه صدک شما را بگوید.

بیشتر آزمون‌های رایگان آنلاین در مورد سوم شکست می‌خورند. نوشتن 30 سؤال قابل‌قبول آسان است. اما تعیین شکل توزیع نمرات در میان هزاران آزمون‌دهنده نماینده پرهزینه است، و سایتی که آزمون را رایگان می‌دهد انگیزه چندانی برای پرداخت آن هزینه ندارد.

مسئله تورم نمره

دلیلی تجاری وجود دارد که چرا آزمون‌های آنلاین بسیاری اعدادی در دهه‌های 120 و 130 برمی‌گردانند. نمره‌ای چاپلوسانه به اشتراک گذاشته می‌شود. نمره 103 در گروه چت منتشر نمی‌شود، و سایتی که به ترافیک ارجاعی وابسته است این را زود یاد می‌گیرد.

تورم به دو شکل رخ می‌دهد. آزمون می‌تواند خیلی آسان باشد، چنان‌که بیشتر آزمون‌دهندگان نزدیک سقف جمع شوند و مقیاس کشیده شود تا این خوشه استثنایی به نظر برسد. یا منحنی نمره‌دهی می‌تواند به‌سادگی سخاوتمندانه باشد و 70 درصد پاسخ درست را به 130 تبدیل کند چون چیزی مانع آن نیست. هیچ‌کدام از داخل آزمون قابل تشخیص نیست. نشانه در سطح جمعیت است: اگر توزیع منتشرشده یک آزمون نشان دهد بیشتر کاربران بالای 120 هستند، کالیبراسیون اشتباه است، چون طبق تعریف تنها حدود 9 درصد از مردم چنین‌اند.

یک بررسی منطقی مفید این است که دو آزمون بی‌ارتباط را انجام دهید. توانایی شناختی واقعی پایدار است، پس فاصله 30 نمره‌ای بین دو نتیجه یعنی دست‌کم یکی از آن‌ها بد کالیبره شده است.

چه چیزی را آزمون‌های آنلاین کمتر خوب می‌سنجند

حتی آزمون آنلاینی که با دقت ساخته شده چیزهایی را از دست می‌دهد که یک ارزیابی بالینی ثبت می‌کند. هیچ ممتحنی وجود ندارد که ببیند شما چگونه به مسئله نزدیک می‌شوید، و از همان‌جاست که یک روان‌شناس به راهبرد، تحمل ناکامی، و این‌که آیا نمره پایین بازتاب توانایی است یا اضطراب پی می‌برد. زیرآزمون‌های زمان‌دار که به دست‌کاری مکعب‌های فیزیکی نیاز دارند اصلاً از طریق مرورگر قابل ارائه نیستند.

شرایط کنترل‌نشده است. ارزیابی بالینی در اتاقی ساکت با یک مجری آموزش‌دیده انجام می‌شود. آزمون آنلاین هرجایی که نشسته‌اید انجام می‌شود، شاید با گوشی‌ای که کنار شما روشن می‌شود. این تفاوت هم نویز تصادفی نیست، چون به‌طور نظام‌مند نمرات کسانی را که در شرایط بدتری آزمون می‌دهند کاهش می‌دهد.

هیچ‌کس بررسی نمی‌کند که آیا چیزی را جست‌وجو کرده‌اید. آزمون‌های خوداجراشونده کاملاً به تقلب‌نکردن آزمون‌دهنده متکی‌اند، که برای کنجکاوی شخصی خوب است و برای هر استفاده رسمی فاقد اعتبار.

چگونه نمره یک آزمون آنلاین را بخوانیم

آن را برآوردی با حاشیه‌ای وسیع در نظر بگیرید. حتی آزمون‌های هوشی که به‌صورت حرفه‌ای اجرا می‌شوند بازه اطمینانی گزارش می‌کنند، معمولاً حدود پنج نمره به هر طرف؛ آزمون آنلاین حاشیه‌ای وسیع‌تر را شایسته است.

بخش آموزنده‌تر یک نتیجه خوب تفکیک دسته‌بندی‌هاست. مجموع 112 چیز چندانی به شما نمی‌گوید. اما دانستن این‌که از تشخیص الگوی قوی و استدلال کلامی به‌طور محسوسی ضعیف‌تر آمده چیزی به شما می‌گوید که می‌توانید بر اساس آن عمل کنید، و شکل این نیمرخ در آزمون‌های مختلف پایدارتر از عدد اصلی است.

نتیجه را جدی به‌عنوان یک نشانه بگیرید و سبک به‌عنوان یک واقعیت. اگر آزمونی 95 بگوید و شما خسته بوده‌اید و آن را در قطار با گوشی انجام داده‌اید، آن عدد توانایی شما را توصیف نمی‌کند. اگر سه آزمون جداگانه در شرایط معقول همگی حدود 95 نشان دهند، آن ارزش توجه دارد.

جایگاه IQ SpeedRun کجاست

درباره آزمون خودمان صریح‌بودن ارزشش را دارد. این آزمون از قالب‌های سؤالی استفاده می‌کند که مجموعه‌های استاندارد به کار می‌برند، یعنی استدلال ماتریسی، سری‌های عددی، قیاس‌های کلامی، و چرخش فضایی، و نتیجه را روی مقیاس متعارفی گزارش می‌کند که در آن 100 نقطه میانی و 15 نمره برابر با یک انحراف معیار است. هر جلسه 25 سؤال را از بانکی با 30 سؤال به ترتیب تصادفی می‌کشد، پس تکرار آزمون همان برگه نیست.

این آزمون به‌صورت بالینی اجرا نمی‌شود، نمونه هنجاریابی نظارت‌شده‌ای ندارد، و نمی‌توان از آن برای تشخیص، جای‌گذاری مدرسه‌ای، یا ورود به یک انجمن هوش بالا استفاده کرد. ما این را در هر صفحه آزمون می‌گوییم، نه در یک پانویس. این آزمون طراحی شده تا برآوردی معقول و تفکیکی مفید از جایگاه نقاط قوت شما بدهد، و باید دقیقاً همین‌طور خوانده شود.

General IQ Test

25 سؤال، 31 دقیقه، به‌محض پایان نمره‌دهی می‌شود.

General IQ Test را بدهید

سؤالاتی که مردم هم می‌پرسند

آیا می‌توان از یک آزمون هوش آنلاین برای Mensa استفاده کرد؟

خیر. Mensa فقط آزمون‌های استاندارد و نظارت‌شده از فهرست تأییدشده خود را می‌پذیرد که در شرایط کنترل‌شده اجرا شوند. هیچ آزمون آنلاین بدون نظارتی واجد شرایط نیست، از جمله آزمون ما. Mensa همچنین آزمون پذیرش نظارت‌شده خودش را برگزار می‌کند که مسیر معمول است.

چرا در دو آزمون آنلاین نمره متفاوتی گرفتم؟

بیشتر اوقات، کالیبراسیون متفاوت است. دو آزمون که بر پایه نمونه‌های متفاوت هنجاریابی شده‌اند، یا اصلاً هنجاریابی نشده‌اند، همان عملکرد را در نقاط متفاوتی از مقیاس قرار می‌دهند. تفاوت محتوا هم مهم است: آزمونی که بار سنگینی روی واژگان دارد فرد متفاوتی را نسبت به آزمونی با بار سنگین چرخش فضایی مطلوب می‌کند.

به خواندن ادامه دهید

Dr. Sarah Chen پژوهشگر روان‌شناسی شناختی است و بر ارزیابی هوش و روان‌سنجی تمرکز دارد؛ او در این‌جا درباره چگونگی ساخت، نمره‌دهی و بدخوانی آزمون‌ها می‌نویسد. راهنماهای بیشتر
← همه راهنماها همه نه ارزیابی را ببینید →