Ada yang tepat, kebanyakan tidak, dan format bukan yang menentukannya. Kajian 2024 yang mentadbir WAIS-IV dari jauh mendapati skor yang sepadan dengan ujian bersemuka pada korelasi di atas .90, jadi mengambil ujian melalui pelayar tidak dengan sendirinya merosakkan keputusan. Yang merosakkan keputusan ialah cara ujian dibina: sama ada soalan ditulis oleh seseorang terlatih dalam psikometrik, sama ada pemarkahan dikalibrasi terhadap sampel sebenar, dan sama ada tapak ada insentif untuk memberi anda nombor yang menyanjung.

Apa yang benar-benar menjadikan ujian IQ tepat

Tiga sifat yang melakukan kerja itu, dan tiada satu pun kelihatan dari halaman pendaratan.

Kebolehpercayaan ialah sama ada ujian memberi anda skor serupa apabila anda mengambilnya semula. Ujian dengan kebolehpercayaan lemah mengukur hingar. Kesahan ialah sama ada ia mengukur perkara yang didakwanya. Kuiz yang kebanyakannya menguji kelajuan membaca boleh sangat boleh dipercayai dan masih bukan ujian kecerdasan. Penormaan ialah langkah kalibrasi: skor hanya bermakna berbanding populasi rujukan, dan ujian yang tidak pernah ditadbir kepada sampel wakil tidak boleh jujur memberitahu persentil anda.

Kebanyakan ujian dalam talian percuma gagal pada yang ketiga. Menulis 30 soalan yang munasabah adalah mudah. Menetapkan rupa taburan skor merentasi ribuan pengambil ujian wakil adalah mahal, dan tapak yang memberi ujian percuma tiada banyak alasan untuk membayarnya.

Masalah inflasi skor

Ada sebab komersial begitu ramai ujian dalam talian mengembalikan nombor dalam julat 120-an dan 130-an. Skor yang menyanjung dikongsi. Skor 103 tidak dimuat naik ke sembang kumpulan, dan tapak yang bergantung pada trafik rujukan cepat belajar ini.

Inflasi berlaku dua cara. Ujian boleh terlalu mudah, sehingga kebanyakan pengambil berkumpul berhampiran siling dan skala diregangkan supaya kelompok itu kelihatan luar biasa. Atau lengkung pemarkahan semata-mata murah hati, memetakan 70% betul kepada 130 kerana tiada apa yang menghalangnya. Kedua-duanya tidak dapat dikesan dari dalam ujian. Petandanya ialah pada tahap populasi: jika taburan terbitan ujian sendiri menunjukkan kebanyakan pengguna di atas 120, kalibrasi salah, kerana menurut definisi hanya kira-kira 9% orang berada di situ.

Semakan kewarasan yang berguna ialah mengambil dua ujian yang tidak berkaitan. Keupayaan kognitif sebenar adalah stabil, jadi jurang 30 mata antara dua keputusan bermakna sekurang-kurangnya satu daripadanya dikalibrasi teruk.

Apa yang ujian dalam talian ukur kurang baik

Malah ujian dalam talian yang dibina teliti kehilangan perkara yang ditangkap penilaian klinikal. Tiada pemeriksa yang memerhati cara anda mendekati masalah, iaitu tempat ahli psikologi mengesan strategi, toleransi kekecewaan, dan sama ada skor rendah mencerminkan keupayaan atau kebimbangan. Subujian berwaktu yang bergantung pada memanipulasi blok fizikal tidak boleh disampaikan melalui pelayar langsung.

Keadaan tidak terkawal. Penilaian klinikal berlaku dalam bilik senyap dengan pentadbir terlatih. Ujian dalam talian berlaku di mana sahaja anda duduk, mungkin dengan telefon menyala di sebelah anda. Varians itu juga bukan hingar rawak, kerana ia secara sistematik menekan skor bagi orang yang diuji dalam keadaan lebih buruk.

Tiada siapa menyemak sama ada anda mencari apa-apa. Ujian tadbir sendiri bergantung sepenuhnya pada pengambil tidak menipu, yang sesuai untuk rasa ingin tahu peribadi dan menolak kelayakan untuk sebarang penggunaan rasmi.

Cara membaca skor daripada ujian dalam talian

Anggap ia sebagai anggaran dengan margin luas. Malah ujian IQ yang ditadbir secara profesional melaporkan selang keyakinan, biasanya sekitar plus atau minus lima mata; ujian dalam talian layak mendapat yang lebih luas.

Bahagian lebih bermaklumat dalam keputusan yang baik ialah pecahan kategori. Jumlah 112 memberitahu anda sedikit. Mengetahui bahawa ia datang daripada pengecaman corak yang kuat dan penaakulan lisan yang nyata lebih lemah memberitahu anda sesuatu yang boleh anda tindak, dan bentuk profil itu lebih stabil merentas ujian berbanding nombor utama.

Ambil keputusan serius sebagai isyarat dan ringan sebagai fakta. Jika ujian kata 95 dan anda letih serta mengambilnya pada telefon dalam kereta api, nombor itu tidak menggambarkan keupayaan anda. Jika tiga ujian berasingan yang diambil dalam keadaan munasabah semuanya mendarat berhampiran 95, itu berbaloi diberi perhatian.

Di mana IQ SpeedRun berada

Berbaloi terus terang tentang ujian kami sendiri. Ia menggunakan format item yang digunakan bateri terpiawai, iaitu penaakulan matriks, siri nombor, analogi lisan, dan putaran spatial, dan ia melaporkan pada skala konvensional di mana 100 ialah titik tengah dan 15 mata ialah satu sisihan piawai. Setiap sesi menarik 25 soalan daripada bank 30 item dalam susunan rawak, jadi pengambilan semula bukan kertas yang sama.

Ia bukan ditadbir secara klinikal, ia tiada sampel norma diselia, dan ia tidak boleh digunakan untuk diagnosis, penempatan sekolah, atau kemasukan ke persatuan IQ tinggi. Kami katakan ini pada setiap halaman ujian, bukan dalam nota kaki. Ia dibina untuk memberi anda anggaran munasabah dan pecahan berguna di mana kekuatan anda berada, dan sepatutnya dibaca sebagai tepat itu.

General IQ Test

25 soalan, 31 minit, dinilai sebaik sahaja anda selesai.

Ambil General IQ Test

Soalan yang orang juga tanya

Bolehkah ujian IQ dalam talian digunakan untuk Mensa?

Tidak. Mensa hanya menerima ujian terpiawai yang diselia daripada senarai diluluskannya, ditadbir dalam keadaan terkawal. Tiada ujian dalam talian tanpa penyeliaan yang layak, termasuk kami. Mensa juga menjalankan ujian kemasukan diselia sendiri, yang merupakan laluan biasa.

Mengapa saya mendapat skor berbeza pada dua ujian dalam talian?

Kalibrasi berbeza, paling kerap. Dua ujian yang dinormakan terhadap sampel berbeza, atau tidak dinormakan langsung, akan meletakkan prestasi yang sama pada titik berbeza pada skala. Perbezaan kandungan juga penting: ujian yang berat pada perbendaharaan kata akan memihak orang berbeza berbanding yang berat pada putaran spatial.

Teruskan membaca

Dr. Sarah Chen ialah penyelidik psikologi kognitif yang menumpukan pada penilaian kecerdasan dan psikometrik, dan menulis di sini tentang cara ujian dibina, dinilai, dan disalah baca. Lagi panduan
← Semua panduan Lihat semua sembilan penilaian →