Grup karşılaştırma
Dunn Testi
Üç ve daha fazla bağımsız grubun sıralarını ikişerli karşılaştırır; sıralamayı bir kez kurar ve çok karşılaştırma için p değerlerini düzeltir.
Yöntem özeti
Dunn testi, genel bir sıra testi grupların ayrıştığını gösterdikten sonra hangi ikililerin bu ayrışmadan sorumlu olduğunu bulmak için kullanılır. Yordamın ayırt edici yanı sıralamayı bütün örneklem üzerinde tek seferde kurmasıdır: her grubun ortalama sırası aynı ortak sıralamadan okunur, ikililer kendi aralarında yeniden sıralanmaz. Böylece karşılaştırmalar birbiriyle tutarlı bir ölçek üzerinde durur ve genel testin kullandığı bilgiyle aynı tabana oturur. Her ikili için ortalama sıra farkı, bu farkı standartlaştıran bir z değeri ve buna karşılık gelen p değeri hesaplanır; varyans teriminde eşit değerler için açık bir düzeltme uygulanır. Karşılaştırma sayısı arttıkça yanlış pozitif birikeceği için p değerleri Holm ya da Bonferroni yordamıyla düzeltilir, düzeltmeyi kapatma seçeneği de vardır.
Hangi araştırma sorularında kullanılır?
- Dört şubenin hizmet kalitesi derecelendirmelerinden hangi şube ikilileri birbirinden ayrışıyor?
- Beş yaş kuşağı arasında bildirilen teknoloji kullanım sıklığı hangi kuşak çiftlerinde farklılaşıyor?
- Üç eğitim düzeyinin sıralı tutum yanıtlarından hangileri anlamlı biçimde ayrı duruyor?
- Genel sıra testi anlamlı çıktığı bir veride farkın kaynağı tek bir grup mu, yoksa birden çok ikili mi?
Ne zaman kullanılmalıdır?
- Genel bir sıra testi üç ya da daha fazla grup arasında ayrışma gösterdikten sonra kaynağı aramak gerektiğinde.
- Bağımlı değişken sıralı olduğunda ya da sürekli değişkende normallik savunulamadığında.
- İkili karşılaştırmaların ortak bir sıralama üzerinde kurulması ve genel testle aynı tabanı paylaşması istendiğinde.
- Çok sayıda ikili karşılaştırmanın yanlış pozitif birikimi düzeltme ile denetim altında tutulacağında.
Gerekli değişken türleri
- Bağımlı değişken: sıralı ya da sayısal olarak kodlanmış tek bir ölçüm sütunu.
- Bağımsız değişken: en az üç kategorisi olan tek bir gruplama sütunu; daha azında motor analizi yürütmez.
- Her satır tek bir katılımcıyı temsil eder ve yalnız bir gruba aittir.
Temel varsayımlar
- Gözlemlerin bağımsızlığı
- Gruplar farklı katılımcılardan oluşur. Aynı kişiden birden çok koşul ölçülmüşse ikili karşılaştırmalar eşleştirilmiş bir yordam gerektirir.
- En az sıralı ölçüm düzeyi
- Bütün örneklemin tek bir sıralamaya dizilebilmesi için değerlerin anlamlı biçimde karşılaştırılabilir olması gerekir.
- Üç ve daha fazla grup
- Yordam çoklu karşılaştırma sorununu çözmek için tasarlandığından en az üç grup ister. İki grupta düzeltilecek bir şey kalmaz.
- Dağılım biçimlerinin benzerliği
- Sonucu konum farkı olarak okumak için grupların dağılım biçimlerinin benzer olması gerekir. Biçimler belirgin biçimde ayrışıyorsa anlamlı bir ikili, yayılım farkını da yansıtıyor olabilir.
YouReply bu varsayımları nasıl kontrol eder?
- Gözlemlerin bağımsızlığı: Panel bu varsayımı otomatik denetlemez; değerlendirme araştırmacıya aittir.
- En az sıralı ölçüm düzeyi: Yöntem seçici ölçüm alanı için sayısal bir sütun, gruplama alanı için en az üç kategorili bir sütun arar; uymayan seçimlerde yöntem soluklaştırılır.
- Üç ve daha fazla grup: Motor gruplama sütununda üçten az kategori bulursa analizi reddeder ve gerekçesini bildirir.
- Dağılım biçimlerinin benzerliği: Panel dağılım biçimlerini denetlemez; bu değerlendirmeyi betimsel istatistiklere bakarak araştırmacı yapar.
Analiz nasıl yürütülür?
- 1Veri dosyanızı panele yükleyin ve Veri sekmesinde gruplama sütunundaki kategori adlarının tutarlı yazıldığını denetleyin.
- 2Değişken sekmesinde ölçüm sütununun düzeyini sıralı olarak işaretleyin ve kategori etiketlerini tanımlayın.
- 3Analiz sekmesinde yöntem seçiciden Dunn testini seçin; veri koşulları kutusu hangi sütunların üç ve daha fazla kategori taşıdığını gösterir.
- 4Parametre formunda gruplama sütununu, ölçüm sütununu ve düzeltme yordamını belirtin; düzeltme Holm, Bonferroni ya da kapalı olabilir.
- 5Analizi çalıştırın; karşılaştırma tablosu, grup başına ortalama sıra tablosu, anlamlı çiftlerin listesi ve kullanılan düzeltmenin adı ayrı başlıklarda açılır.
- 6Karşılaştırma tablosunu Excel olarak indirin ve raporunuzda hangi düzeltmeyi kullandığınızı belirtin.
Üretilen istatistikler ve tablolar
- Karşılaştırma tablosu
- Her ikili için iki grubun adı, ortalama sıra farkı, z değeri, ham p değeri, iki grubun gözlem sayıları, düzeltilmiş p değeri ve anlamlılık işareti.
- Grup başına ortalama sıra
- Bütün örneklem üzerinde kurulan ortak sıralamadan okunan ortalama sıralar; farkın yönünü bu değerler verir.
- Grup büyüklükleri ve toplam gözlem
- Her grubun gözlem sayısı ve analize giren toplam gözlem sayısı; dengesizlik z değerlerinin büyüklüğünü etkiler.
- Karşılaştırma sayıları
- Yürütülen ikili karşılaştırma sayısı ve bunlardan kaçının düzeltilmiş p değerine göre anlamlı sayıldığı.
- Anlamlı çiftler listesi
- Düzeltilmiş p değeri eşiğin altında kalan ikililerin ayrı bir liste hâlinde derlenmiş hâli.
- Kullanılan düzeltme
- Hesaplamada hangi çoklu karşılaştırma yordamının uygulandığı; raporda belirtilmesi gereken bilgidir.
Etki büyüklüğü ve güven aralığı
- Karşılaştırma başına z değeri
- Yordam ayrı bir etki büyüklüğü ölçüsü döndürmez; elinizdeki standartlaştırılmış ölçü, her ikili için hesaplanan z değeridir. Bu değer ortalama sıra farkını grup büyüklüklerinden ve eşitlik düzeltmesinden gelen standart hataya bölerek elde edilir, dolayısıyla örneklem büyüklüğüne bağımlıdır ve gruplar arası karşılaştırmalarda etki ölçüsü gibi kullanılmamalıdır. Farkın pratik büyüklüğünü değerlendirmek için ortalama sıra farkını ve grup ortancalarını birlikte okumanız yerinde olur.
Bu yordam hiçbir karşılaştırma için güven aralığı üretmez; ortalama sıra farkları ve z değerleri nokta tahmini olarak verilir. Konum farkı için aralık gerekiyorsa ayrı bir hesaplama yapmanız gerekir.
Örnek araştırma sorusu ve örnek sonuç
Aşağıdaki sayılar temsili bir örnektir; gerçek bir araştırmanın ya da gerçek bir kullanıcının verisi değildir.
- Araştırma sorusu
- Bir hizmet araştırmasında, dört şubede toplanan beş basamaklı tavsiye etme eğilimi yanıtlarından hangi şube ikilileri birbirinden ayrışıyor?
- Değişkenler
- Ölçüm değişkeni: tavsiye etme eğilimi (1-5, sıralı) · Gruplama değişkeni: şube (dört kategori)
- Örnek sonuç
- Toplam gözlem 164. Ortalama sıralar: birinci şube 68,0 (n = 41), ikinci şube 79,0 (n = 42), üçüncü şube 89,2 (n = 40), dördüncü şube 94,1 (n = 41). Altı karşılaştırma, Holm düzeltmesi. Birinci ile dördüncü şube: sıra farkı -26,1, z = -3,37, ham p = 0,0008, düzeltilmiş p = 0,005. Birinci ile üçüncü şube: sıra farkı -21,2, z = -2,74, ham p = 0,0062, düzeltilmiş p = 0,031. İkinci ile dördüncü şube: z = -1,95, ham p = 0,051, düzeltilmiş p = 0,204. Kalan üç karşılaştırmanın düzeltilmiş p değerleri 0,468 ve üzerinde. Anlamlı karşılaştırma sayısı 2.
- Yorum
- Ayrışmanın kaynağı birinci şube: tavsiye etme eğilimi sıraları hem üçüncü hem dördüncü şubeden belirgin biçimde aşağıda duruyor. İkinci ile dördüncü şube arasındaki fark ham p değerinde eşiğe değiyor ama altı karşılaştırma için düzeltildikten sonra anlamlılığını yitiriyor; bu, düzeltmeyi kapatmanın neden yanıltıcı olacağını gösteren tipik bir örnek. Üçüncü ile dördüncü şube arasında ayrışma görünmüyor, yani sonuç iki uç arasında bir derecelenme değil, tek bir şubenin geride kalması biçiminde okunuyor.
Örnek veri setiyle gerçek çıktı
Aşağıdaki sonuçları analiz motoru bu veri dosyasını çözümleyerek üretti. Değişkeni değiştirdiğinizde araştırma sorusu da değişiyor; sonuçların tamamı önceden hesaplandı, sayfa motora istek göndermiyor.
Genel müşteri anketi (sentetik)
Üç yüz yanıtlayıcılı geniş bir anket: iki ve üç kategorili gruplayıcılar, sürekli ölçümler, beşli sıralı ölçek, iki kategorili satın alma sonucu, dört kategorili marka tercihi, üç tekrarlı ölçüm, eşleştirilmiş ikili sorular, üç kodlayıcı, dört fiyat sorusu ve kasıtlı olarak boş bırakılmış hücreler.
- Satır sayısı
- 300
- Sütunlar
- katilimci_no, cinsiyet, egitim_duzeyi, bolge, yas, gelir, memnuniyet, hizmet_puani, fiyat_puani, kalite_puani, baglilik, tavsiye_skoru, satin_aldi, marka_tercihi, memnuniyet_duzeyi, on_puan, son_puan, olcum_1, olcum_2, olcum_3, kullanim_once, kullanim_sonra, kullanim_izleme, kodlayici_1, kodlayici_2, kodlayici_3, fiyat_cok_ucuz, fiyat_ucuz, fiyat_pahali, fiyat_cok_pahali, geri_bildirim_puani, izleme_puani
Veri sentetiktir: gerçek bir araştırmadan değil, sabit bir tohumla üretildi. Aşağıdaki değerleri analiz motoru bu dosyayı çözümleyerek üretti; aynı dosyayı panele yükleyince aynı sonuçları görürsünüz.
Araştırma sorusu: Üç eğitim düzeyinden hangi ikilileri gelir bakımından birbirinden ayrılıyor?
- Grup değişkeni
- egitim_duzeyi
- Ölçülen değişken
- gelir
- Çoklu karşılaştırma düzeltmesi
- holm
- adjust
- holm
- Toplam gözlem
- 300
- Karşılaştırma sayısı
- 3
- Anlamlı çıkan karşılaştırma sayısı
- 3
İkili karşılaştırmalar
| Birinci grup | İkinci grup | Ortalama sıra farkı | z değeri | p değeri | Birinci grubun büyüklüğü | İkinci grubun büyüklüğü | p değeri (düzeltilmiş) | Anlamlı |
|---|---|---|---|---|---|---|---|---|
| Lisans | Lisansüstü | -38,26 | -3,09 | 0,002 | 100 | 96 | 0,002 | Evet |
| Lisans | Lise | 105,40 | 8,68 | < 0,001 | 100 | 104 | < 0,001 | Evet |
| Lisansüstü | Lise | 143,65 | 11,70 | < 0,001 | 96 | 104 | < 0,001 | Evet |
Ortalama sıralar
- Lisans
- 174,80
- Lisansüstü
- 213,05
- Lise
- 69,40
Grup büyüklükleri
- Lisans
- 100
- Lisansüstü
- 96
- Lise
- 104
Hesaplama künyesi: scipy 1.18.0 · statsmodels 0.14.6 · scikit-learn 1.9.0 · numpy 2.5.1 · pandas 3.0.5 · semopy 2.3.11 · 89fc29a · Veri tohumu: 20260914
Sonuç nasıl raporlanır?
Holm düzeltmeli Dunn karşılaştırmaları, tavsiye etme eğiliminde birinci şubenin dördüncü şubeden (z = -3,37, düzeltilmiş p = 0,005) ve üçüncü şubeden (z = -2,74, düzeltilmiş p = 0,031) anlamlı biçimde ayrıştığını, kalan dört ikilide ise fark bulunmadığını gösterdi (N = 164).
APA düzenine yakın örnek cümle; sayılar temsilidir.
Ne zaman kullanılmamalıdır?
- Genel bir sıra testi anlamlı çıkmadan bütün ikilileri taramak, araştırma sorusunu veriye göre kurmak anlamına gelir ve raporlanması güçtür.
- Aynı katılımcılardan alınan tekrarlı ölçümlerde kullanılmaz; eşleştirilmiş tasarımda ikililer için işaretli sıra yordamı gerekir.
- Grup sayısı arttıkça karşılaştırma sayısı hızla büyür ve düzeltme, gerçek farkları da eşiğin üstüne itebilir.
- Düzeltmeyi kapatma seçeneği yanlış pozitif oranını denetimsiz bırakır; keşif amaçlı bir bakış dışında kullanılmamalıdır.
- Çıktıda karşılaştırma başına z dışında etki büyüklüğü bulunmadığı için pratik anlam değerlendirmesi ortanca ve sıra farkı okumasına kalır.
- Çok küçük gruplarda z değeri normal yaklaşıklığa dayandığı için düzeltilmiş p değerleri kırılgan hâle gelir.
Varsayımlar karşılanmazsa kullanılabilecek yöntemler
- Kruskal-Wallis H TestiNeden: İkililerden önce genel kararı almak gerekiyorsa; panelde bu yöntem anlamlı çıktığında Bonferroni düzeltmeli ikişerli Mann-Whitney karşılaştırmalarını da kendiliğinden üretir.
- Mann-Whitney U TestiNeden: Yalnız belirli bir grup ikilisi için kuramsal bir beklenti varsa ve bütün ikilileri taramak gerekmiyorsa.
- Tek Yönlü ANOVANeden: Ölçüm sürekli ve dağılım varsayımları savunulabiliyorsa; anlamlı F sonrası dört ayrı post-hoc yordam birlikte hesaplanır.
Sık sorulan sorular
- Bu yordam ile Kruskal-Wallis yönteminin ürettiği ikili karşılaştırmalar aynı şey mi?
- Değil. Panelin Kruskal-Wallis yöntemi, genel testi anlamlı çıktığında her ikiliyi ayrı bir Mann-Whitney koşusu olarak ele alır ve bunlara Bonferroni düzeltmesi uygular; her koşu kendi iki grubunu yeniden sıralar. Dunn testi ise sıralamayı bütün örneklem üzerinde bir kez kurar ve bu ortak sıralamadan okunan ortalama sıralar üzerinden çalışır, yani genel testle aynı tabanı paylaşır. Bu yüzden standart post-hoc tercih edilir ve bu yöntemi ayrıca çalıştırmanız gerekir.
- Holm ile Bonferroni arasında hangisini seçmeliyim?
- İkisi de aile düzeyindeki yanılma oranını denetler. Bonferroni her p değerini karşılaştırma sayısıyla çarparak en temkinli sonucu verir; Holm, p değerlerini sıralayıp kademeli bir çarpan uygular ve aynı korumayı daha az güç kaybıyla sağlar. Çoğu durumda Holm tercih edilir, ama hakeminiz klasik Bonferroni istiyorsa o seçenek de mevcuttur.
- Düzeltmeyi kapatmak ne zaman makul olur?
- Pratikte yalnız tablonun ham hâlini görmek istediğinizde. Düzeltme kapalıyken her karşılaştırma kendi yüzde beş yanılma payıyla çalışır ve altı karşılaştırmada en az bir yanlış pozitif bulma olasılığı yüzde yirmi beşe yaklaşır. Raporlanan sonuçta düzeltilmiş p değerlerini kullanmanız ve hangi yordamı uyguladığınızı yazmanız beklenir.
- Eşit yanıtların çok olduğu kısa ölçeklerde sonuç güvenilir mi?
- Yordam eşitlikleri hesaba katar: z değerinin standart hatasında eşit değerler için açık bir düzeltme uygulanır, dolayısıyla kısa ölçeklerde p değerleri sistematik biçimde şişmez. Buna karşılık eşitlikler çoğaldıkça sıralamanın taşıdığı bilgi azalır ve gerçek farkları yakalama gücü düşer.
Kaynaklar
- Dunn, O. J. (1964). Multiple Comparisons Using Rank Sums
- Conover, W. J. (1999). Practical Nonparametric Statistics
- Holm, S. (1979). A Simple Sequentially Rejective Multiple Test Procedure
- scipy.stats.rankdata belgeleri
Kendi verinizle deneyin
Ücretsiz planda ayda 50 analiz koşusu vardır; kart istenmez.