Geçerlilik ve güvenilirlik, ölçme işleminin iki temel niteliğidir. Yöntem bölümünüzde bu iki başlığı kanıtlarla desteklemezseniz, bulgularınızın tamamı tartışmaya açık hâle gelir.
Temel ayrım
Klasik hedef tahtası benzetmesi:
- Güvenilir ama geçerli değil: Atışlar birbirine çok yakın ama merkezden uzak. Tutarlı biçimde yanlış ölçüyorsunuz.
- Geçerli ama güvenilir değil: Atışlar merkez etrafında ama dağınık. Ortalamada doğru, tek tek güvenilmez.
- Hem geçerli hem güvenilir: Atışlar merkezde ve birbirine yakın. Hedeflenen budur.
Geçerlilik türleri
1. Kapsam geçerliliği (content validity)
Maddelerin, ölçülmek istenen kavramın tüm boyutlarını temsil edip etmediğidir. Uzman görüşüyle kanıtlanır.
Lawshe tekniği: Her uzman maddeyi üç kategoriden birine yerleştirir. Kapsam Geçerlilik Oranı:
KGO = (Ne − N/2) / (N/2)
Ne = “gerekli” diyen uzman sayısı, N = toplam uzman sayısı. 10 uzman için minimum kabul değeri 0,62’dir.
2. Yapı geçerliliği (construct validity)
Ölçeğin, kuramsal olarak tanımlanan yapıyı gerçekten ölçüp ölçmediğidir. En güçlü kanıt faktör analizidir.
Yakınsak geçerlilik (convergent validity): Aynı yapıyı ölçen maddelerin birbiriyle yüksek ilişki göstermesi.
- Standartlaştırılmış faktör yükleri ≥ 0,50 (tercihen ≥ 0,70)
- AVE (Ortalama Açıklanan Varyans) ≥ 0,50
- CR (Bileşik Güvenilirlik) ≥ 0,70
Ayırt edici geçerlilik (discriminant validity): Farklı yapıları ölçen boyutların birbirinden yeterince ayrışması.
- Fornell-Larcker ölçütü: Her boyutun AVE karekökü, o boyutun diğer boyutlarla korelasyonundan büyük olmalı.
- HTMT oranı: 0,85’in (esnek yaklaşımda 0,90) altında olmalı.
3. Ölçüt geçerliliği (criterion validity)
- Eş zamanlı geçerlilik: Ölçeğin, aynı anda ölçülen bilinen bir ölçütle ilişkisi. Yeni bir depresyon ölçeği, mevcut geçerli bir ölçekle yüksek korelasyon göstermelidir.
- Yordayıcı geçerlilik: Ölçeğin gelecekteki bir sonucu öngörme gücü. Bir iş performansı ölçeği, altı ay sonraki gerçek performansı yordamalıdır.
4. Görünüş geçerliliği (face validity)
Ölçeğin, katılımcının gözünde ilgili konuyu ölçüyor görünmesi. En zayıf kanıttır ancak katılımcı motivasyonu açısından önemlidir — anlamsız görünen maddeler terk oranını artırır.
Güvenilirlik türleri
1. İç tutarlılık
- Cronbach alfa: En yaygın. ≥ 0,70 kabul edilir.
- McDonald omega: Faktör yükleri eşit değilse daha doğru sonuç verir; giderek yaygınlaşmaktadır.
- Bileşik güvenilirlik (CR): Yapısal eşitlik modellemesinde tercih edilir.
2. Test-tekrar test güvenilirliği
Aynı gruba 2–4 hafta arayla iki kez uygulama yapılır. İki uygulama arasındaki korelasyon ≥ 0,70 olmalıdır.
Dikkat: Süre çok kısa olursa katılımcılar ilk yanıtlarını hatırlar (hatırlama etkisi); çok uzun olursa gerçek değişim olabilir.
3. Eş değer formlar güvenilirliği
Aynı yapıyı ölçen iki paralel form arasındaki korelasyon. Sınav ölçmelerinde yaygın, anket araştırmalarında nadir.
4. Kodlayıcılar arası güvenilirlik
Nitel verilerin kodlanmasında veya gözlem çalışmalarında, iki bağımsız kodlayıcının uyumu. Cohen’s kappa ile hesaplanır; 0,61–0,80 arası iyi, 0,81 üzeri mükemmel uyum sayılır.
Yöntem bölümünde nasıl yazılır?
“Ölçeğin yapı geçerliliği doğrulayıcı faktör analizi ile sınanmış ve üç faktörlü yapının veriye iyi uyum gösterdiği belirlenmiştir (χ²/sd = 2,08; CFI = ,95; TLI = ,94; RMSEA = ,058; SRMR = ,043). Standartlaştırılmış faktör yükleri ,61 ile ,84 arasında değişmekte olup tüm boyutlar için AVE değerleri ,50’nin (,54–,63), bileşik güvenilirlik değerleri ise ,70’in (,79–,86) üzerindedir. Ayırt edici geçerlilik Fornell-Larcker ölçütüyle incelenmiş ve her boyutun AVE karekökünün diğer boyutlarla olan korelasyonlarından yüksek olduğu görülmüştür. İç tutarlılık katsayıları Cronbach alfa ile ,78–,89 aralığında hesaplanmıştır.”
Sık yapılan hatalar
- Yalnızca Cronbach alfa raporlayıp “geçerlilik ve güvenilirlik sağlandı” demek. Alfa geçerlilik kanıtı değildir.
- Uyarlanmış ölçekte geçerlilik analizini atlamak. Başka bir kültürde geçerli olması, sizin örnekleminizde geçerli olduğunu göstermez.
- Ayırt edici geçerliliği hiç test etmemek. Boyutlar birbirinden ayrışmıyorsa modeliniz çöker.
- Görünüş geçerliliğini kanıt olarak sunmak.
- Test-tekrar testi 2 gün arayla yapmak. Hatırlama etkisi sonucu şişirir.
Sonuç
Geçerlilik ve güvenilirlik, yöntem bölümünüzün en çok sorgulanan kısmıdır. Her iddianızı sayısal bir kanıtla destekleyin; “ölçek geçerli ve güvenilirdir” cümlesi tek başına hiçbir şey ifade etmez.
Ölçek uyarlıyorsanız ölçek uyarlama rehberimize, güvenilirlik hesaplama detayları için Cronbach alfa rehberimize göz atın.