Çoklu Grup Test-Tekrar Test Güvenilirliği
Multi-group Test-Retest Reliability Analysis · Ayrıca şöyle bilinir: multi-group temporal stability, cross-group test-retest reliability, group-comparative retest reliability, multi-sample temporal consistency
Çoklu grup test-tekrar test güvenilirliği, bir ölçüm aracının iki veya daha fazla tanımlanmış grup — örneğin farklı cinsiyetler, yaş grupları veya klinik popülasyonlar — için zaman içinde istikrarlı puanlar üretip üretmediğini değerlendirir ve bu zamansal istikrar derecesinin bu gruplar arasında eşdeğer olup olmadığını belirler.
Tam yöntemi oku
Bu bölümü okumak için ücretsiz hesapla giriş yapın.
Yöntem haritası
İlişkili yöntemlerin komşuluğu — keşfetmek için bir düğüm seçin.
Ne zaman kullanılır
Çoklu popülasyonlarda bir ölçeğin geçerliliğini doğrulamak ve bu popülasyonlar arasında zamansal tutarlılığın eşitliği bilimsel veya pratik bir gereklilik olduğunda çoklu grup test-tekrar test güvenilirliğini kullanın. Tipik senaryolar arasında, enstrümanların kültürel uyarlaması, demografik olarak çeşitli örneklemlerle kullanılan klinik değerlendirme araçları ve okul kohortları arasında karşılaştırılan eğitim testleri yer alır. Yalnızca tek bir grubun ilgili olduğu durumlarda, yapının tekrar test penceresi içinde önemli ölçüde değişmesinin beklendiği durumlarda (bu durumda test-tekrar test güvenilirliği herhangi bir grup için uygun değildir) veya alt gruplardaki örneklem büyüklüklerinin yorumlanabilir güven aralıkları elde etmek için çok küçük olduğu (n < 30) durumlarda bu prosedürü kullanmayın.
Güçlü yönler & sınırlılıklar
- Tek bir toplu ICC'nin gizleyeceği grup-spesifik güvenilirliği ortaya çıkarır, bu da daha adil ölçek değerlendirmesi sağlar.
- ICC, tekrarlanan ölçümleri uygun şekilde ele alan iyi kurulmuş bir varyans bileşenleri çerçevesine (Shrout & Fleiss, 1979) dayanmaktadır.
- Gruplar arasında ICC'leri karşılaştırmak için Fisher z-testi, nokta tahminlerinin gayri resmi karşılaştırması yerine resmi bir istatistiksel test sağlar.
- Demografik veya klinik alt gruplar arasında farklı zamansal istikrarı ortaya çıkararak ölçüm araçlarının eşitlik denetimini destekler.
- Herhangi bir puanlanmış ölçeğe — toplam puanlar, alt ölçek puanları veya bireysel maddeler — faktör analitik bir model gerektirmeden uygulanabilir.
- İki veri toplama dalgası gerektirir, bu da onu tekil uygulama güvenilirlik indekslerinden lojistik olarak daha zorlu ve maliyetli hale getirir.
- Optimal tekrar test aralığı yapıya bağlıdır ve genellikle belirsizdir; çok kısa olması hafıza bulaşmasını davet eder, çok uzun olması gerçek değişimin ölçüm hatası olarak gizlenmesine neden olur.
- Grup-spesifik ICC tahminleri, alt grup örneklem büyüklükleri küçük olduğunda hassas olmayabilir, bu da bilgilendirici olmayan geniş güven aralıkları verir.
- Maddelerin gruplar arasında aynı şekilde işlev görüp görmediğini ele almaz — bunun için KBY ile ölçüm değişmezliği testi gereklidir.
- Dalgalar arasındaki kayıp (takip dışı kalan katılımcılar), bırakma rastgele değilse veya gruplar arasında farklılık gösteriyorsa yanlılığa neden olabilir.
SSS
Çoklu grup test-tekrar test güvenilirliği, ölçüm değişmezliği testinden nasıl farklıdır?
Test-tekrar test güvenilirliği zamansal istikrara odaklanır: aynı katılımcılardan alınan puanlar iki vesilede mi korelasyon gösterir? Ölçüm değişmezliği testi, faktör yüklemelerinin, kesişimlerin ve hata varyanslarının tek bir zaman noktasında gruplar arasında eşit olup olmadığını incelemek için doğrulamalı faktör analizi kullanır. Her ikisi de gruplar arası karşılaştırmalar için önemlidir, ancak farklı geçerlilik sorularını ele alırlar ve birbirlerinin yerini tutamazlar.
Hangi ICC modelini kullanmalıyım?
İki zaman noktası sabit ve önemsediğiniz tüm vesileleri oluşturan — en yaygın senaryo — durumlarda iki yönlü karışık etkili ICC'yi (Shrout & Fleiss notasyonunda Model 3) kullanın. Vesilelerin daha geniş bir olası ölçüm anları evreninden bir örneklem olduğu durumlarda iki yönlü rastgele etkili ICC'yi (Model 2) kullanın. Tek yönlü ICC'ler genellikle test-tekrar test için uygun değildir çünkü ratör (vesile) varyansını artık varyanstan ayıramazlar.
Her grup ne kadar büyük olmalı?
Evrensel bir minimum yoktur, ancak bilgilendirici olacak kadar dar güven aralıkları elde etmek için grup başına en az 30 ila 50 katılımcı pratik bir kılavuzdur. Daha küçük gruplar, nokta tahminleri olarak kabul edilebilir görünen, ancak güven aralığı zayıftan mükemmele kadar tüm aralığı kapsayan ICC'ler verir, bu da tahmini karar verme için neredeyse işe yaramaz hale getirir.
Hangi tekrar test aralığını kullanmalıyım?
Aralık, katılımcıların önceki cevaplarını hatırlayamayacakları kadar uzun (genellikle çoğu psikolojik ölçek için en az iki hafta) ancak ölçülen yapının anlamlı bir şekilde değişmemiş olacağı kadar kısa olmalıdır. Kişilik gibi kararlı özellikler için iki ila dört haftalık aralıklar yaygındır. Dalgalanabilen durumlar veya klinik semptomlar için uygun aralık daha kısa olabilir, ancak analist o zaman gözlemlenen istikrarsızlığın gerçek değişime değil, ölçüm hatasına yansıdığını savunmalıdır.
İkiden fazla grubu karşılaştırabilir miyim?
Evet. Grup-spesifik ICC'ler ve güven aralıkları her grup için bağımsız olarak hesaplanır. İkili Fisher z-testleri tüm çiftleri karşılaştırır veya bir omnibus test, ICC'lerin tüm gruplar arasında homojen olup olmadığını eş zamanlı olarak değerlendirebilir. Çok sayıda grupla, birden fazla karşılaştırma için anlamlılık eşiğini ayarlayın.
Kaynaklar
- Shrout, P. E. & Fleiss, J. L. (1979). Intraclass correlations: Uses in assessing rater reliability. Psychological Bulletin, 86(2), 420–428. DOI: 10.1037/0033-2909.86.2.420 ↗
- Vandenberg, R. J. & Lance, C. E. (2000). A review and synthesis of the measurement invariance literature: Suggestions, practices, and recommendations for organizational research. Organizational Research Methods, 3(1), 4–70. DOI: 10.1177/109442810031002 ↗
Bu sayfayı kaynak gösterin
ScholarGate. (2026, June 3). Multi-group Test-Retest Reliability Analysis. ScholarGate. https://scholargate.app/tr/psychometrics/multi-group-test-retest-reliability
Hangi yöntem?
Bu yöntemi en yakın akrabalarının yanına koyup yan yana okuyun — kütüphane kitapları masaya serer; seçim sizindir.
- Doğrulayıcı faktör analizi (DFA)Psikometri↔ karşılaştır
- Çoklu Grup Doğrulayıcı Faktör Analizi (MG-CFA)Psikometri↔ karşılaştır
- Çoklu Grup Cronbach AlfaPsikometri↔ karşılaştır
- Çok Gruplu Ölçüm Değişmezliği TestiPsikometri↔ karşılaştır
- Test-Tekrar GüvenilirliğiPsikometri↔ karşılaştır