Bilgisayarlı Uyarlanabilir Test (BUT)
Computerized Adaptive Testing (CAT) · Ayrıca şöyle bilinir: Adaptive Testing, Tailored Testing, Item-Adaptive Testing, Bilgisayar Destekli Uyarlanabilir Test
Bilgisayarlı Uyarlanabilir Test (BUT), bir bilgisayar algoritmasının her adayın gizil yeteneklerinin anlık tahminine dayanarak ardışık test maddelerini seçtiği bireyselleştirilmiş bir değerlendirme metodolojisidir. Madde Yanıt Teorisi'ne (MYT) dayanan BUT, her soruyu mevcut yetenek tahminine göre en uygun şekilde bilgilendirici olacak şekilde madde dizisini dinamik olarak uyarlar. Bu çerçeve, Howard Wainer ve meslektaşları tarafından ilk olarak 1990'da yayımlanan ve 2000'deki ikinci baskısında genişletilen temel kılavuz aracılığıyla sistematikleştirilmiş ve popülerleştirilmiştir.
Tam yöntemi oku
Bu bölümü okumak için ücretsiz hesapla giriş yapın.
Yöntem haritası
İlişkili yöntemlerin komşuluğu — keşfetmek için bir düğüm seçin.
Ne zaman kullanılır
Bireysel düzeyde kesinliğin grup düzeyindeki karşılaştırmalardan daha önemli olduğu ve 100 veya daha fazla kalibre edilmiş maddeden oluşan bir madde bankasının mevcut olduğu durumlarda BUT uygundur. Uygun bir MYT modeli (Rasch, 2PL veya 3PL) altında önceden kalibre edilmiş maddeler, güvenilir bir bilgisayar dağıtım sistemi ve kabul edilebilir maruz kalma kontrol kısıtlamaları gerektirir. Yeniden testin madde bankası yenilenmeden yaygın olduğu, madde güvenliğinin garanti edilemediği veya tüm adayların yasal karşılaştırılabilirlik için aynı maddeleri alması gerektiği durumlarda BUT'tan kaçının. Alternatifler arasında çok aşamalı uyarlanabilir test (MST) veya doğrusal anlık test (LOFT) bulunur.
Güçlü yönler & sınırlılıklar
- Geleneksel sabit form testlere göre %40–60 daha az maddeyle eşdeğer ölçüm hassasiyeti elde eder, bu da aday yorgunluğunu azaltır.
- Gerçek zamanlı yetenek tahminleri ve standart hatalar sağlar, bu da anında puan raporlamasını mümkün kılar.
- Her adayı bireysel olarak uyarlar, bu da değerlendirme deneyimini yetenek düzeyleri arasında daha ilgi çekici ve uygun hale getirir.
- Her adayın büyük, kalibre edilmiş bir bankadan çekilen benzersiz bir madde seti alması nedeniyle esnek test pencerelerini destekler.
- Büyük, önceden kalibre edilmiş madde bankası (genellikle boyut başına 100+ madde) ve önemli ölçüde ön maliyetli psikometrik yatırım gerektirir.
- Madde maruz kalma ve içerik dengeleme kısıtlamaları algoritmik karmaşıklık katar ve ölçüm verimliliğini azaltabilir.
- Uyarlanabilir seçim, katı madde düzeyinde adalet veya yasal savunulabilirlik tüm adaylar için aynı maddeleri gerektirdiğinde puan karşılaştırılabilirliğini karmaşıklaştırır.
- Yetenek dağılımının uç noktalarında yetenek tahmini daha az stabildir, burada madde bankası kapsamı genellikle zayıftır.
SSS
Sabit form bir testle karşılaştırıldığında bir BUT tipik olarak kaç madde gerektirir?
Ampirik çalışmalar tutarlı bir şekilde, BUT'un yaklaşık %40–60 daha az madde kullanarak sabit form bir testle aynı ölçüm hassasiyetini elde ettiğini göstermektedir; bu oran madde bankası büyüklüğüne, durdurma kriterine ve yetenek dağılımına bağlıdır. 200 maddelik sabit bir form için, eşdeğer bir BUT genellikle yetenek dağılımının merkezine yakın adaylar için 50–80 madde içinde yakınsar.
Farklı maddeler verildiğinde BUT puanları farklı uygulamalar arasında karşılaştırılabilir mi?
Evet, maddeler ortak bir MYT ölçeğinde kalibre edildiği sürece. BUT puanları aynı temel metrik üzerinde tahmin edilen gizil özellik değerleri (teta) olarak ifade edildiğinden, uygulamalar ve adaylar arasındaki karşılaştırmalar geçerlidir. Bu, MYT tabanlı uyarlanabilir testin temel avantajlarından biridir: ölçüm modeli uyduğu sürece puan anlamı madde-bağımsızdır.
Bir aday yetenek ölçeğinin uç noktalarında performans gösterirse ne olur?
Uç noktalarda, madde bankası tipik olarak daha az iyi hedeflenmiş madde içerir, bu nedenle standart hata daha yavaş azalır ve durdurma kriterine maksimum madde sınırına ulaşılana kadar ulaşılamayabilir. Taban veya tavan yakınındaki puanlar daha az hassastır ve bu durumları işaretlemek ve uygun dikkatle yorumlamak iyi bir uygulamadır.
Kaynaklar
- Wainer, H. (2000). Computerized Adaptive Testing: A Primer (2nd ed.). Lawrence Erlbaum Associates. ISBN: 978-0-8058-3511-3
Bu sayfayı kaynak gösterin
ScholarGate. (2026, June 2). Computerized Adaptive Testing (CAT). ScholarGate. https://scholargate.app/tr/psychometrics/computerized-adaptive-testing
Hangi yöntem?
Bu yöntemi en yakın akrabalarının yanına koyup yan yana okuyun — kütüphane kitapları masaya serer; seçim sizindir.
- Rasch ModeliPsikometri↔ karşılaştır