Likert ölçekli anket verisi hangi testle analiz edilir?
SPSS · Oğuzhan Çiçek · İstatistikçi · Yaklaşık 5 dk okuma
Yayın:
Kısa cevap
Likert ölçeğinde tek bir madde sıralı (ordinal) veridir ve medyan ile parametrik olmayan testlerle (Mann-Whitney U, Kruskal-Wallis, Spearman) incelenir. Birden çok maddenin toplanmasıyla elde edilen ölçek veya alt boyut puanı ise uygulamada sürekli kabul edilir; örneklem yeterliyse ve dağılım aşırı çarpık değilse t-testi, ANOVA, Pearson korelasyonu ve regresyon kullanılabilir. Karar, verinin maddeye mi toplam puana mı dayandığına göre verilir.
Bu yazıda neler var?
Tez danışmanlığında en sık aldığımız sorulardan biri şu: "Anketim Likert tipi, t-testi yapabilir miyim?" Kısa cevabı yukarıda verdik; uzun cevap, verinizin hangi düzeyde analiz edileceğine bağlı. Aynı anketten iki farklı veri türü çıkar ve ikisi için kurallar farklıdır. Bu yazıda o ayrımı, tezlerde sık yapılan hataları ve jürinin bu konuda ne sorduğunu anlatıyoruz.
Önce ayrım: madde düzeyi mi, ölçek puanı mı?
Beşli Likert maddesinde katılımcı "Kesinlikle katılmıyorum" ile "Kesinlikle katılıyorum" arasında bir seçenek işaretler. Bu seçenekler sıralıdır ama aralıkları eşit değildir; "katılıyorum" ile "kesinlikle katılıyorum" arasındaki mesafe, "kararsızım" ile "katılıyorum" arasındakine eşit olmak zorunda değildir. Bu yüzden tek bir madde sıralı (ordinal) veridir; ortalaması alınabilir ama bu ortalamanın yorumu tartışmalıdır.
Ölçek geliştirme mantığı farklı çalışır. Aynı yapıyı ölçen 8–10 madde toplanıp bir boyut puanı oluşturulduğunda, olası puan sayısı artar (örneğin 8 maddelik beşli ölçekte 8–40 arası 33 farklı değer), dağılım sürekli bir değişkene yaklaşır ve ölçme literatüründe bu puan aralıklı düzeyde kabul edilir. Tezlerdeki analizlerin büyük bölümü bu toplam puanlar üzerinden yapılır; yani sorun çoğu zaman sanıldığından küçüktür.
Toplam puanlarla hangi testler kullanılır?
Ölçek veya alt boyut puanıyla çalışıyorsanız karar, klasik test seçim mantığıyla aynıdır:
- İki bağımsız grubun (ör. cinsiyet) puan ortalaması: bağımsız örneklem t-testi
- Üç ve daha fazla grubun (ör. sınıf düzeyi, kıdem) karşılaştırması: tek yönlü ANOVA, anlamlı farkta post hoc test
- İki ölçek puanı arasındaki ilişki: Pearson korelasyonu
- Bir ölçek puanının diğerlerini yordaması: çoklu doğrusal regresyon
- Aynı kişilerde ön test–son test: eşleştirilmiş t-testi
Normallik koşulu burada devreye girer. Toplam puanlarda ciddi çarpıklık yoksa ve grup başına 30'un üzerinde gözlem varsa parametrik testler güvenle kullanılır; merkezi limit teoremi örneklem ortalamalarının dağılımını korur. Çarpıklık ve basıklık değerlerinin ±1 (bazı kaynaklarda ±2) aralığında kalması pratik bir eşiktir. Shapiro-Wilk testinin büyük örneklemde en küçük sapmayı bile anlamlı bulduğunu unutmayın; test sonucundan çok histogram ve katsayılara bakın. Bu konuyu normallik testi ve parametrik test seçimi yazısında ayrıntılı ele aldık.
Dağılım belirgin biçimde çarpıksa ya da örneklem küçükse parametrik olmayan karşılıklar kullanılır: Mann-Whitney U, Kruskal-Wallis, Spearman korelasyonu, Wilcoxon işaretli sıralar.
Tek madde analiz edilecekse ne yapılır?
Bazı tezlerde araştırma sorusu tek bir maddeye bağlıdır: "Uzaktan eğitimi yüz yüze eğitime tercih ederim" maddesine verilen yanıtların bölümlere göre farklılaşıp farklılaşmadığı gibi. Burada toplam puan yoktur, veri sıralıdır ve kurallar sıkılaşır:
- Betimleyici istatistik olarak ortalama yerine medyan ve yüzde dağılımı verilir ("Katılımcıların %62'si katılıyorum veya kesinlikle katılıyorum dedi").
- Grup karşılaştırmasında Mann-Whitney U (iki grup) ya da Kruskal-Wallis (üç ve daha fazla grup) kullanılır.
- Kategorik bir değişkenle ilişki için beşli yanıt üçe indirgenip (katılmıyor / kararsız / katılıyor) ki-kare uygulanabilir; göze sayıları küçükse birleştirme zorunlu hale gelir.
- İki madde arasındaki ilişki için Spearman korelasyonu seçilir.
Tek madde üzerinde t-testi yapmak hatalı mı? Literatürde iki görüş vardır ve simülasyon çalışmaları beşli Likert'te t-testinin çoğu durumda Mann-Whitney ile benzer sonuç verdiğini gösterir. Ancak jüri ve hakemler bu tartışmaya girmek istemez; tek madde için parametrik olmayan testi tercih etmek savunması en kolay yoldur.
Tezlerde en sık gördüğümüz beş hata
- Ters maddeleri çevirmeden toplam almak. "Bu işten keyif almıyorum" gibi olumsuz maddeler ters kodlanmadan toplanırsa güvenirlik düşer, ilişkiler sönükleşir. Cronbach alfa beklenenden düşükse ilk bakılacak yer burasıdır; bkz. Cronbach alfa nedir, kaç olmalı?
- Alt boyutları görmezden gelip yalnız genel puanla analiz yapmak. Ölçeğin orijinal çalışmasında üç boyut varsa hipotezler çoğu zaman boyut düzeyinde kurulmalıdır.
- Her maddeyi tek tek gruplara göre test etmek. 30 madde × 4 grup karşılaştırması, çoklu test sorununu doğurur; şans eseri anlamlı sonuçlar birikir. Bu konu çoklu test ve yanlış pozitif yazısında.
- Ortalamayı "3'ün üzerinde, yüksek düzey" diye yorumlamak. Puan aralığı (1–5) üçe ya da beşe bölünerek düzey tanımı yapılacaksa aralık genişliği (0,80) açıkça yazılmalı ve bu düzeylendirmenin keyfi bir kabul olduğu belirtilmelidir.
- Normallik sağlanmadı diye bütün analizi parametrik olmayana çevirmek. Toplam puanda hafif çarpıklık, 100'ün üzerindeki örneklemde sorun değildir; gereksiz yere güç kaybedilir.
Jüri ne sorar, nasıl cevaplanır?
Tez savunmalarında bu konuda üç soru tekrarlanır. "Likert verisi ordinal değil mi, neden t-testi?" sorusuna cevap: analiz tek maddeye değil, iç tutarlılığı gösterilmiş ölçek puanına dayanıyor; puan 8–40 aralığında 33 farklı değer alıyor ve dağılım kabul edilebilir sınırlar içinde. "Normallik testi anlamlı çıkmış, nasıl parametrik test kullandınız?" sorusuna cevap: Shapiro-Wilk büyük örneklemde aşırı duyarlıdır; çarpıklık ve basıklık katsayıları ile histogram verildi. "Ortalama 3,42'nin anlamı ne?" sorusuna cevap: düzeylendirme ölçütü yöntem bölümünde tanımlandı, yorum o ölçüte göre yapıldı.
Bu cevapların tezde hazır bulunması için yöntem bölümünde "veri analizi" alt başlığına şu üç cümlenin eşdeğerinin yazılması yeterlidir: hangi puanların nasıl hesaplandığı, normallik değerlendirmesinin hangi ölçütle yapıldığı ve hangi testlerin hangi koşulda seçildiği.
Raporlama için kısa şablon
Toplam puanla iki grup karşılaştırmasında bulgu cümlesi şu biçimde yazılır: "Kadın katılımcıların tükenmişlik puanları (Ort = 28,4; SS = 6,1), erkek katılımcılardan (Ort = 25,1; SS = 5,8) anlamlı düzeyde yüksektir, t(214) = 3,92; p < ,001; d = 0,55." Tek madde için: "Katılımcıların %58'i maddeye katıldığını belirtmiştir; bölümler arasında anlamlı fark bulunmamıştır, H(3) = 4,21; p = ,240." Etki büyüklüğünü eklemeyi ihmal etmeyin; p değeri tek başına farkın büyüklüğünü söylemez.
Ölçek verisi olan bir tez üzerinde çalışıyorsanız veri setinizi ve ölçeğin orijinal makalesini gönderin; hangi puanların hangi testle analiz edileceğini kapsam teklifinde madde madde yazarız.
İlgili hizmetler