Grup karşılaştırma
Mann-Whitney U Testi
İki bağımsız grubu ortalamalar üzerinden değil, birleştirilmiş sıralamalar üzerinden karşılaştırır; normal dağılım varsayımı gerektirmez.
Yöntem özeti
Mann-Whitney U testi, iki gruptaki tüm gözlemleri tek bir sıralamaya dizer ve her grubun sıra toplamını karşılaştırır. Sıfır hipotezi, rastgele seçilen bir gözlemin bir gruptan gelme olasılığının ötekine kıyasla eşit olmasıdır; pratikte bu, iki dağılımın konum bakımından ayrışmadığı biçiminde okunur. Ölçüm değerlerinin kendisi değil, büyüklük sıraları kullanıldığı için aykırı değerlerden ve çarpık dağılımlardan daha az etkilenir. Likert tipi sıralı yanıtlarda ve küçük örneklemlerde t-testine tercih edilir. Motor, sıra tablosunun yanında U değerini, normal yaklaşıklıkla elde edilen Z değerini ve etki büyüklüğü olarak sıra-çift serili korelasyonu verir.
Hangi araştırma sorularında kullanılır?
- İki farklı kullanıcı grubunun beş basamaklı memnuniyet maddesindeki yanıtları ayrışıyor mu?
- Kentsel ve kırsal katılımcıların algılanan hizmet kalitesi sıralamaları farklı mı?
- Deney ve kontrol grubunun küçük örneklemli bir çalışmada tepki süreleri farklılaşıyor mu?
- Abone olan ve olmayan kullanıcıların uygulama içi etkinlik düzeyi ayrışıyor mu?
Ne zaman kullanılmalıdır?
- İki bağımsız grup karşılaştırılırken bağımlı değişken sıralı ölçekteyse.
- Sürekli bir değişkende normallik varsayımı belirgin biçimde ihlal ediliyorsa.
- Örneklem küçükken ve dağılımın biçimi hakkında güçlü bir sayıltı kurulamıyorsa.
- Aykırı değerler ortalamayı sürüklediği için ortalama karşılaştırması yanıltıcı olacaksa.
Gerekli değişken türleri
- Bağımlı değişken: sıralı ya da sürekli, sayısal olarak kodlanmış tek bir sütun.
- Bağımsız değişken: tam olarak iki kategorili gruplama sütunu.
- Her grupta en az üç geçerli gözlem; motor bunun altında hata döndürür.
Temel varsayımlar
- Gözlemlerin bağımsızlığı
- İki grup farklı katılımcılardan oluşur ve gözlemler birbirini etkilemez. Eşleştirilmiş ölçümlerde bu test kullanılmaz.
- En az sıralı ölçüm düzeyi
- Değerlerin küçükten büyüğe anlamlı biçimde sıralanabilmesi gerekir. Sıralanamayan kategorik veride test anlamsızdır.
- Grup başına yeterli gözlem
- Normal yaklaşıklıkla hesaplanan Z değerinin ve p değerinin anlamlı olabilmesi için her grupta yeterli gözlem bulunmalıdır.
- Dağılım biçimlerinin benzerliği
- Sonucu medyan farkı olarak yorumlamak istiyorsanız iki grubun dağılım biçimi benzer olmalıdır. Biçimler belirgin biçimde farklıysa test, konum değil genel dağılım farkı hakkında konuşur.
YouReply bu varsayımları nasıl kontrol eder?
- Gözlemlerin bağımsızlığı: Panel bu varsayımı otomatik denetlemez; değerlendirme araştırmacıya aittir.
- En az sıralı ölçüm düzeyi: Yöntem seçici sayısal bir sütun ister ve gruplama sütununun tam iki kategorili olmasını arar; uymayan seçimlerde yöntem soluklaştırılır.
- Grup başına yeterli gözlem: Motor her grupta en az üç gözlem arar; altında kalırsa analiz çalışmaz ve gerekçesi bildirilir.
- Dağılım biçimlerinin benzerliği: Panel dağılım biçimlerini karşılaştırmaz; bu değerlendirme betimsel istatistikler ve grafiklerle araştırmacıya kalır.
Analiz nasıl yürütülür?
- 1Veri dosyanızı panele yükleyin ve sütunların doğru okunduğunu Veri sekmesinde görün.
- 2Değişken sekmesinde sıralı değişkenin ölçek düzeyini işaretleyin ve gruplama sütununun iki kategorili olduğunu doğrulayın.
- 3Analiz sekmesinde yöntem seçiciden Mann-Whitney U testini seçin; veri koşulları kutusu hangi sütunların uygun olduğunu listeler.
- 4Parametre formunda gruplama sütununu ve karşılaştırılacak değişkeni seçin; gerekirse tek yönlü sınama yönünü belirtin.
- 5Analizi çalıştırın; sıra tablosu, U ve Z değerleri, p değeri ve etki büyüklüğü ayrı başlıklarda açılır.
- 6Sonuçları Excel olarak indirin; hesaplama künyesi kartı kullanılan kütüphane çağrısını gösterir.
Üretilen istatistikler ve tablolar
- Sıra tablosu
- Her grup için gözlem sayısı, ortalama sıra ve sıra toplamı; yorumun dayandığı asıl tablo budur.
- U ve Wilcoxon W istatistikleri
- U değeri ile eşdeğeri olan Wilcoxon sıra toplamı istatistiği birlikte raporlanır.
- Z değeri
- Normal yaklaşıklıkla hesaplanan standartlaştırılmış değer; büyük örneklemlerde p değerinin dayanağıdır.
- Asimptotik p değeri
- Seçilen sınama yönüne göre iki ya da tek yönlü olarak raporlanır.
- Etki büyüklüğü
- Sıra-çift serili korelasyon ve büyüklüğünü niteleyen bir etiket sonuçla birlikte verilir.
Etki büyüklüğü ve güven aralığı
- Sıra-çift serili korelasyon
- Bir gruptan rastgele seçilen gözlemin ötekinden büyük olma eğilimini özetler. Mutlak değeri 0,1 civarında küçük, 0,3 civarında orta, 0,5 ve üzerinde büyük etki olarak yorumlanır; işaret hangi grubun yukarıda sıralandığını gösterir.
Bu yöntemde ne konum farkı ne de etki büyüklüğü için güven aralığı hesaplanır; sonuçlar nokta tahmini olarak verilir. Medyan farkı için aralık gerekiyorsa ayrı bir hesaplama yapmanız gerekir.
Örnek araştırma sorusu ve örnek sonuç
Aşağıdaki sayılar temsili bir örnektir; gerçek bir araştırmanın ya da gerçek bir kullanıcının verisi değildir.
- Araştırma sorusu
- Bir kullanılabilirlik araştırmasında, iki arayüz tasarımını deneyen bağımsız gruplar görev zorluğunu beş basamaklı bir maddede farklı mı değerlendiriyor?
- Değişkenler
- Bağımlı değişken: algılanan görev zorluğu (1-5, sıralı) · Bağımsız değişken: arayüz tasarımı (A / B)
- Örnek sonuç
- A grubu (n = 34) ortalama sıra 29,1; B grubu (n = 31) ortalama sıra 37,3. U = 394,5, Z = -1,98, p = 0,048, sıra-çift serili korelasyon = 0,25.
- Yorum
- B tasarımını deneyen katılımcılar zorluk maddesinde sistematik biçimde daha yüksek sıralanıyor. Etki küçük ile orta arasında ve p değeri sınıra yakın; tek bir maddeye dayanan bu sonucu görev tamamlama süresi gibi başka ölçümlerle birlikte değerlendirmek gerekir.
Örnek veri setiyle gerçek çıktı
Aşağıdaki sonuçları analiz motoru bu veri dosyasını çözümleyerek üretti. Değişkeni değiştirdiğinizde araştırma sorusu da değişiyor; sonuçların tamamı önceden hesaplandı, sayfa motora istek göndermiyor.
Genel müşteri anketi (sentetik)
Üç yüz yanıtlayıcılı geniş bir anket: iki ve üç kategorili gruplayıcılar, sürekli ölçümler, beşli sıralı ölçek, iki kategorili satın alma sonucu, dört kategorili marka tercihi, üç tekrarlı ölçüm, eşleştirilmiş ikili sorular, üç kodlayıcı, dört fiyat sorusu ve kasıtlı olarak boş bırakılmış hücreler.
- Satır sayısı
- 300
- Sütunlar
- katilimci_no, cinsiyet, egitim_duzeyi, bolge, yas, gelir, memnuniyet, hizmet_puani, fiyat_puani, kalite_puani, baglilik, tavsiye_skoru, satin_aldi, marka_tercihi, memnuniyet_duzeyi, on_puan, son_puan, olcum_1, olcum_2, olcum_3, kullanim_once, kullanim_sonra, kullanim_izleme, kodlayici_1, kodlayici_2, kodlayici_3, fiyat_cok_ucuz, fiyat_ucuz, fiyat_pahali, fiyat_cok_pahali, geri_bildirim_puani, izleme_puani
Veri sentetiktir: gerçek bir araştırmadan değil, sabit bir tohumla üretildi. Aşağıdaki değerleri analiz motoru bu dosyayı çözümleyerek üretti; aynı dosyayı panele yükleyince aynı sonuçları görürsünüz.
Araştırma sorusu: Memnuniyet dağılımı kadın ve erkek katılımcılar arasında farklılaşıyor mu?
- Grup değişkeni
- cinsiyet
- Karşılaştırılan ölçüm sütunları
- memnuniyet
- Sınamanın yönü
- two-sided
- Grup değişkeni
- cinsiyet
- Çözümlenen değişken
- memnuniyet
Sıralar
| Satır | Kadın | Erkek | Toplam |
|---|---|---|---|
| Sample Size | 159 | 141 | 300 |
| Mean Rank | 154,33 | 146,18 | - |
| Sum of Ranks | 24.538,00 | 20.612 | - |
Test istatistikleri
- Mann-Whitney U
- 11.818
- Wilcoxon W
- 24.538
- Z değeri
- 0,811
- Asimptotik p değeri (iki yönlü)
- 0,417
Etki büyüklüğü
- Sıra çift serili korelasyon
- -0,054
Hesaplama künyesi: scipy 1.18.0 · statsmodels 0.14.6 · scikit-learn 1.9.0 · numpy 2.5.1 · pandas 3.0.5 · semopy 2.3.11 · 89fc29a · Veri tohumu: 20260914
Sonuç nasıl raporlanır?
Algılanan görev zorluğu iki tasarım arasında anlamlı biçimde farklılaştı, U = 394,5, Z = -1,98, p = 0,048, r = 0,25 (A grubu ortalama sıra 29,1; B grubu 37,3).
APA düzenine yakın örnek cümle; sayılar temsilidir.
Ne zaman kullanılmamalıdır?
- Üç ve daha fazla grup karşılaştırılacaksa kullanılmaz; Kruskal-Wallis testi gerekir.
- Aynı kişilerden alınan önce-sonra ölçümlerinde kullanılmaz; eşleştirilmiş tasarımda Wilcoxon işaretli sıralar testi uygundur.
- Grup dağılımlarının biçimi belirgin biçimde farklıysa sonuç medyan farkı olarak yorumlanamaz.
- Çok sayıda eşit değerin bulunduğu kısa ölçeklerde sıralama bilgisi zayıflar ve testin gücü düşer.
- Normallik varsayımı sağlanan sürekli verilerde t-testine kıyasla daha düşük güç verir; varsayımlar tutuyorsa parametrik testi tercih edin.
Varsayımlar karşılanmazsa kullanılabilecek yöntemler
- Bağımsız Örneklem t-TestiNeden: Bağımlı değişken sürekli ve normallik varsayımı karşılanıyorsa; ortalama farkını doğrudan yorumlamayı sağlar.
- Kruskal-Wallis H TestiNeden: Karşılaştırılacak grup sayısı üç ve daha fazlaysa; aynı sıralama mantığını çok gruba genişletir.
- Wilcoxon İşaretli Sıralar TestiNeden: Ölçümler eşleştirilmiş ya da aynı kişilerden alınmışsa; bağımsızlık varsayımı sağlanmaz.
Sık sorulan sorular
- Bu test medyanları mı karşılaştırıyor?
- Doğrudan medyanları değil, sıralamaları karşılaştırır. Sonucun medyan farkı olarak okunabilmesi için iki grubun dağılım biçiminin benzer olması gerekir; biçimler farklıysa test genel olarak dağılımların ayrıştığını söyler.
- Likert maddelerinde t-testi yerine bunu mu kullanmalıyım?
- Tek bir Likert maddesi sıralı bir ölçüm olduğu için bu test daha savunulabilir bir seçimdir. Birden çok maddeden oluşan ve toplam puan üretilen ölçeklerde ise sürekli kabul edip t-testi kullanmak alan yazında yaygındır; tercihinizi gerekçelendirmeniz beklenir.
- Örneklemim çok küçük, p değeri güvenilir mi?
- Panel p değerini normal yaklaşıklıkla hesaplar. Grup büyüklükleri çok küçükken bu yaklaşıklık zayıflar; sonucu etki büyüklüğü ve sıra tablosuyla birlikte, ihtiyatlı yorumlayın.
- Eşit değerler sonucu nasıl etkiler?
- Eşit değerlere ortalama sıra verilir. Kısa ölçeklerde çok sayıda eşitlik olduğunda sıralama bilgisi azalır, testin gücü düşer ve p değeri olduğundan büyük çıkabilir.
Kaynaklar
- Siegel, S., & Castellan, N. J. (1988). Nonparametric Statistics for the Behavioral Sciences
- Conover, W. J. (1999). Practical Nonparametric Statistics
- scipy.stats.mannwhitneyu belgeleri
Kendi verinizle deneyin
Ücretsiz planda ayda 50 analiz koşusu vardır; kart istenmez.