Bilimsel yaklaşımımız
Bir test, arkasındaki kanıt kadar güvenilirdir. Hangi araçları neden seçtiğimizi, neleri bilerek kullanmadığımızı ve sonuçları nasıl yorumladığımızı burada açıkça anlatıyoruz.
Bir testi hangi ölçütlerle seçiyoruz?
- Kanıt
- Ölçeğin güvenirliği ve geçerliği hakemli bilimsel yayınlarla gösterilmiş olmalı. Kendi geliştirdiğimiz testlerde bu kanıt henüz yok; bu testler “pilot” olarak işaretlenir ve durumları test sayfasında açıkça yazılır.
- Kullanım izni
- Ölçeğin çevrim içi ve ücretli bir platformda kullanılmasına izin verilmiş olmalı. Kamu malı ölçekleri (ör. IPIP), açık lisanslı kaynakları ya da yazılı izin aldığımız ölçekleri kullanıyoruz. İzni olmayan bir ölçeği, ne kadar tanınmış olursa olsun kullanmıyoruz.
- Yaşa uygunluk
- Maddelerin dili ve içeriği öğrencinin yaşına uygun olmalı. Her test yalnızca uygun olduğu sınıf düzeylerinde açılır.
Güvenirlik ve geçerlik
Bir testin iyi olup olmadığını iki soru belirler.
Güvenirlik: tutarlı ölçüyor mu?
Aynı kişiyi tarttığınızda banyo tartısı her seferinde aynı kiloyu gösteriyorsa tartı güvenilirdir. Bir testin güvenirliği de maddelerinin aynı özelliği ne kadar tutarlı ölçtüğünü gösterir.
Geçerlik: doğru şeyi mi ölçüyor?
Tartı her seferinde aynı sayıyı gösterip yine de üç kilo eksik tartıyor olabilir. Geçerlik, testin ölçtüğünü söylediği şeyi gerçekten ölçüp ölçmediğidir. Güvenirlik geçerliğin ön koşuludur ama tek başına yetmez.
Ölçüm payı nedir?
Hiçbir test kusursuz değildir. Güvenirliği bilinen ölçeklerde raporda puanın yanında bir ölçüm payı da gösteriyoruz.
Bir öğrenci aynı testi farklı günlerde çözse puanı biraz değişir. Bu değişimin ne kadar olabileceğini testin güvenirliği belirler. Aşağıdaki kaydırıcılarla güvenirlik değiştikçe ölçüm payının nasıl genişleyip daraldığını görebilirsiniz.
Bu güvenirlikte ölçüm payı yaklaşık ±0,51 puan. Yani öğrencinin “gerçek” puanı büyük olasılıkla 3,09 ile 4,11 arasında. Güvenirlik düştükçe sarı bant genişler ve sonuçtan çıkarılabilecek yorum azalır.
Bir testin Türkçe sürümü nasıl doğrulanır?
Uluslararası Test Komisyonu’nun (ITC) test uyarlama yönergelerine göre bir ölçeğin Türkçe sürümü şu beş adımdan geçmelidir. Kendi geliştirdiğimiz testler için de aynı adımlar gerekir.
Çeviri ve sade dil
Maddeler Türkçeye çevrilir ve ergenlerin rahatça anlayacağı bir dile getirilir. Her çevirinin yanında özgün madde metni belgelenir.
Uzman incelemesi
Psikoloji ve ölçme alanından uzmanlar, çevirinin özgün anlamı koruyup korumadığını değerlendirir.
Öğrencilerle anlaşılırlık denemesi
Maddeler küçük bir öğrenci grubuna okutulur; yanlış anlaşılan ifadeler düzeltilir.
Güvenirlik ve geçerlik çalışması
Test, velilerin bilgilendirilmiş onayıyla yeterli sayıda öğrenciye uygulanır. İç tutarlılık (Cronbach alfa), madde analizi, faktör yapısı ve yaş ile cinsiyet grupları arasında ölçme eşdeğerliği incelenir.
Norm çalışması
Türkiye’yi temsil eden bir örneklemle sınıf düzeylerine göre normlar hesaplanır. Ancak bundan sonra puanlar akranlarla karşılaştırılarak, yüzdelik değerlerle yorumlanabilir.
Sitedeki testler bu adımların neresinde?
Çevirisini yaptığımız testlerde (Beş Faktör Kişilik ve Öz-saygı) yalnızca ilk adım tamamlandı; kendi geliştirdiğimiz testler yazılmış ve kaynaklarıyla belgelenmiş durumda. Hiçbir test için uzman incelemesi, güvenirlik ve geçerlik ya da norm çalışması henüz yapılmadı. Sitemiz hiçbir test cevabını saklamadığı için bu çalışmalar site üzerinden yapılamaz; ancak katılımcıların bilgilendirilmiş onayıyla yürütülen ayrı bir araştırmayla yapılabilir.
Her testin sayfasındaki bilim kartında o testin durumu yazar. Testlere göz atın
Norm yokken sonuçları nasıl yorumluyoruz?
Norm, bir puanın aynı yaştaki öğrencilerle karşılaştırıldığında nerede durduğunu gösterir. Türkçeye uyarlanmış ölçeklerin çoğunda güvenirlik ve geçerlik çalışması vardır, ancak sınıf düzeylerine göre yayımlanmış normlar oldukça azdır.
Normu henüz hazır olmayan testlerde puanı ölçeğin kendi aralığına göre yorumluyoruz: “Bu özelliği kendinde ne kadar görüyorsun?” sorusuna verilen cevapların ortalaması. Bu yorum öğrencinin kendini nasıl tanımladığını gösterir ama akranlarıyla karşılaştırma yapmaz. Rapor bu farkı her zaman açıkça belirtir.
Şu an sitedeki testlerin hiçbirinin Türkiye normu yok; bu yüzden hiçbir raporda “akranlarının yüzde kaçından yüksek” gibi bir karşılaştırma bulunmaz. Sitemiz cevapları saklamadığı için normlar sitedeki cevaplardan oluşturulamaz. Bir test için güvenilir bir norm yayımlanırsa, raporlar ancak o zaman akranlarla karşılaştırma yapmaya başlar ve bu değişiklik test sayfasında açıkça yazılır.
Cevap kalitesini nasıl kontrol ediyoruz?
- Her maddenin cevaplanma süresini ölçüyoruz. Cümleyi okumaya yetmeyecek kadar hızlı verilen cevaplar raporda uyarı olarak görünür.
- Uzun bölümlerde hep aynı seçeneğin işaretlenmesini fark ediyoruz. Testlerde ters yönlü maddeler olduğu için bu durum dikkatsizliğe işaret eder.
- Yeterince madde cevaplanmamışsa o bölüm için puan hesaplamıyoruz.
- Okuma görevinde metin çok hızlı geçildiyse hız değerini güvenilir saymıyoruz.
Neleri bilerek kullanmıyoruz?
İnternette yaygın olan bazı test türlerinin bilimsel dayanağı yok ya da çevrim içi uygulamaya uygun değil.
Projektif testler (mürekkep lekesi, resim çizdirme, cümle tamamlama)
Bu testlerin göstergelerinin büyük bölümünün bilimsel desteği zayıftır; desteklenen az sayıdaki gösterge de ancak eğitimli bir klinisyen tarafından, yüz yüze uygulandığında anlam taşır. İnternette kendi kendine çözülen bir “psikoanaliz testi” geçerli bir ölçüm değildir.
Öğrenme stilleri (görsel, işitsel, kinestetik)
Öğretimi öğrencinin “öğrenme stiline” göre ayarlamanın başarıyı artırdığı fikri kontrollü çalışmalarda büyük ölçüde desteklenmemiştir. 2024 tarihli bir meta-analiz, gözlenen etkilerin yaygın kullanımı haklı çıkaramayacak kadar küçük ve seyrek olduğu sonucuna varmıştır. Bunun yerine, etkisi araştırmalarla gösterilmiş ders çalışma alışkanlıklarını ölçüyoruz.
Sağ beyin / sol beyin testleri
Beynin iki yarımküresi birlikte çalışır. Bin kişiden fazla katılımcıyla yapılan bir beyin görüntüleme çalışması, insanların “sağ beyinli” ya da “sol beyinli” diye ayrılabileceğine dair bir bulgu elde etmemiştir. Bu tür testler çocuğa gereksiz bir etiket verir.
Parmak izinden yetenek tahmini (dermatoglifik testler)
Parmak izi desenleri ile zekâ, yetenek ya da meslek uygunluğu arasında bilimsel olarak gösterilmiş bir ilişki yoktur.
MBTI, Enneagram ve benzeri “tip” testleri
Bu araçlar kişiyi sınırlı sayıda “tipe” yerleştirir. Tekrar uygulamada kişilerin azımsanmayacak bir kısmı farklı bir tip alır; bazılarının kullanımı da lisansa bağlıdır. Kişiliği “ya o ya bu” diye değil, sürekli boyutlarla ölçen Beş Faktör modelini tercih ediyoruz.
Çocuklara çevrim içi zekâ (IQ) puanı
Zekâ testleri standart koşullarda ve eğitimli bir uygulayıcı tarafından yapılmalıdır. Bilişsel görevlerimiz dikkat ve çalışma belleği gibi belirli becerileri ölçer; bir zekâ puanı vermez.
Tanı koymuyoruz
Raporlarımız psikolojik ya da tıbbi bir tanı değildir ve tanının yerine geçmez. Çocuğu etiketlemez; güçlü yanları ve gelişim alanlarını anlatır. Bir sonuç dikkat gerektiriyorsa raporda okulun rehberlik servisine ya da bir uzmana başvurmanızı öneririz.
Veliler için: Ne zaman bir uzmana başvurmalı?
Kaynaklar
- Clinton-Lisell, V. ve Litzinger, C. (2024). Is it really a neuromyth? A meta-analysis of the learning styles matching hypothesis. Frontiers in Psychology, 15, 1428732. doi.org/10.3389/fpsyg.2024.1428732
- Goldberg, L. R. ve ark. (2006). The International Personality Item Pool and the future of public-domain personality measures. Journal of Research in Personality, 40(1), 84–96. doi.org/10.1016/j.jrp.2005.08.007
- International Test Commission (2017). ITC Guidelines for Translating and Adapting Tests (2. baskı). www.intestcom.org/files/guideline_test_adaptation_2ed.pdf
- Lilienfeld, S. O., Wood, J. M. ve Garb, H. N. (2000). The scientific status of projective techniques. Psychological Science in the Public Interest, 1(2), 27–66. doi.org/10.1111/1529-1006.002
- Nielsen, J. A., Zielinski, B. A., Ferguson, M. A., Lainhart, J. E. ve Anderson, J. S. (2013). An evaluation of the left-brain vs. right-brain hypothesis with resting state functional connectivity magnetic resonance imaging. PLOS ONE, 8(8), e71275. doi.org/10.1371/journal.pone.0071275
- Pashler, H., McDaniel, M., Rohrer, D. ve Bjork, R. (2008). Learning styles: Concepts and evidence. Psychological Science in the Public Interest, 9(3), 105–119. doi.org/10.1111/j.1539-6053.2009.01038.x
- Pittenger, D. J. (2005). Cautionary comments regarding the Myers-Briggs Type Indicator. Consulting Psychology Journal: Practice and Research, 57(3), 210–221. doi.org/10.1037/1065-9293.57.3.210