Bazıları doğru, çoğu değil, ve bunu format belirlemez. WAIS-IV'ü uzaktan uygulayan 2024 tarihli bir çalışma, yüz yüze testle .90'ın üzerinde korelasyonla eşleşen puanlar buldu; yani tarayıcıdan test almak tek başına sonucu bozmaz. Sonucu bozan şey testin nasıl kurulduğu: soruları psikometri eğitimi almış birinin yazıp yazmadığı, puanlamanın gerçek bir örnekleme göre kalibre edilip edilmediği ve sitenin size pohpohlayıcı bir sayı vermekte çıkarı olup olmadığı.
Bir IQ testini gerçekten doğru kılan şey
İş üç özelliğe düşer ve hiçbiri açılış sayfasından görünmez.
Güvenilirlik, testi yeniden aldığınızda benzer bir puan verip vermediğidir. Güvenilirliği zayıf bir test gürültü ölçer. Geçerlilik, iddia ettiği şeyi ölçüp ölçmediğidir. Çoğunlukla okuma hızını ölçen bir quiz mükemmel güvenilir olabilir ve yine de bir zeka testi olmayabilir. Normlama kalibrasyon adımıdır: puanlar yalnızca bir referans popülasyona göre anlam taşır ve temsili bir örnekleme hiç uygulanmamış bir test size yüzdelik diliminizi dürüstçe söyleyemez.
Ücretsiz çevrimiçi testlerin çoğu üçüncüde başarısız olur. 30 inandırıcı soru yazmak kolaydır. Puan dağılımının binlerce temsili katılımcıda nasıl göründüğünü kurmak pahalıdır ve testi bedava veren bir sitenin bunun için ödeme yapacak pek bir nedeni yoktur.
Puan şişirme sorunu
Bu kadar çok çevrimiçi testin 120'ler ve 130'larda sayılar döndürmesinin ticari bir nedeni vardır. Pohpohlayıcı bir puan paylaşılır. 103 puanı bir grup sohbetine konmaz ve yönlendirme trafiğine bağımlı bir site bunu çabuk öğrenir.
Şişirme iki yoldan olur. Test çok kolay olabilir, böylece çoğu katılımcı tavana yığılır ve ölçek bu yığını olağanüstü göstermek için gerilir. Ya da puanlama eğrisi cömert olabilir ve %70 doğruyu 130'a eşler, çünkü bunu durduran bir şey yoktur. İkisi de testin içinden fark edilmez. İşaret popülasyon düzeyindedir: bir testin kendi yayımlanmış dağılımı kullanıcıların çoğunu 120'nin üzerinde gösteriyorsa kalibrasyon yanlıştır, çünkü tanım gereği insanların yalnızca yaklaşık %9'u oradadır.
Yararlı bir sağduyu denetimi, birbiriyle ilgisiz iki test almaktır. Gerçek bilişsel yetenek stabildir, bu yüzden iki sonuç arasında 30 puanlık bir fark, en az birinin kötü kalibre edildiği anlamına gelir.
Çevrimiçi testlerin daha zayıf ölçtüğü şeyler
Dikkatle kurulmuş bir çevrimiçi test bile klinik bir değerlendirmenin yakaladıklarını kaybeder. Bir probleme nasıl yaklaştığınızı izleyen bir uygulayıcı yoktur; psikolog stratejiyi, hayal kırıklığına dayanıklılığı ve düşük bir puanın yeteneği mi kaygıyı mı yansıttığını orada görür. Fiziksel blokları manipüle etmeye dayanan zamanlı alt testler tarayıcıdan hiç sunulamaz.
Koşullar kontrol edilmez. Klinik bir değerlendirme, eğitimli bir uygulayıcıyla sessiz bir odada yapılır. Çevrimiçi bir test, oturduğunuz her yerde, belki yanınızda yanan bir telefonla olur. Bu varyans rastgele gürültü de değildir; daha kötü koşullarda test olanların puanlarını sistematik olarak düşürür.
Bir şey bakıp bakmadığınızı kimse denetlemez. Kendi kendine uygulanan testler tamamen katılımcının kopya çekmemesine dayanır; kişisel merak için sorun değildir, resmi herhangi bir kullanım için diskalifiye edicidir.
Çevrimiçi bir testin puanı nasıl okunur
Onu geniş marjlı bir tahmin olarak ele alın. Profesyonel uygulanan IQ testleri bile genellikle artı eksi beş puan civarında bir güven aralığı bildirir; çevrimiçi bir test daha genişini hak eder.
İyi bir sonucun daha bilgilendirici kısmı kategori dökümüdür. 112 toplamı size az şey söyler. Güçlü örüntü tanıma ve belirgin biçimde daha zayıf sözel akıl yürütmeden geldiğini bilmek, üzerine harekete geçebileceğiniz bir şey söyler ve bu profilin şekli, manşet sayıdan daha stabildir.
Sonucu bir sinyal olarak ciddiye alın, bir olgu olarak hafif tutun. Bir test 95 diyorsa ve siz yorgunken trende telefonda aldıysanız, sayı yeteneğinizi tanımlamaz. Makul koşullarda alınan üç ayrı testin hepsi 95 civarına düşüyorsa, buna dikkat etmek gerekir.
IQ SpeedRun nerede durur
Kendi testimiz hakkında açık olmak gerekir. Standart bataryaların kullandığı madde formatlarını kullanır: matris akıl yürütme, sayı dizileri, sözel analojiler ve uzamsal döndürme; ve 100'ün orta nokta, 15 puanın bir standart sapma olduğu geleneksel ölçekte raporlar. Her oturum 30 maddelik bankadan rastgele sırayla 25 soru çeker, böylece tekrar aynı kâğıt olmaz.
Klinik olarak uygulanmaz, denetimli bir norm örneği yoktur ve tanı, okul yerleştirme veya yüksek IQ derneği girişi için kullanılamaz. Bunu dipnotta değil her test sayfasında söyleriz. Makul bir tahmin ve güçlü yanlarınızın nerede durduğuna dair yararlı bir döküm vermek için kurulmuştur ve tam olarak öyle okunmalıdır.
İnsanların ayrıca sorduğu sorular
Çevrimiçi bir IQ testi Mensa için kullanılabilir mi?
Hayır. Mensa yalnızca onaylı listesindeki, denetimli koşullarda uygulanan standart testleri kabul eder. Denetlenmeyen hiçbir çevrimiçi test geçerli değildir, bizimki de dahil. Mensa ayrıca kendi denetimli kabul testini de uygular; olağan yol budur.
İki çevrimiçi testte neden farklı puan aldım?
Çoğu zaman farklı kalibrasyon. Farklı örneklemlere göre normlanmış, ya da hiç normlanmamış iki test, aynı performansı ölçekte farklı noktalara yerleştirir. İçerik farkı da önemlidir: kelime ağırlıklı bir test, uzamsal döndürme ağırlıklı olandan farklı bir kişiyi kayırır.