Grup karşılaştırma
Wilcoxon İşaretli Sıralar Testi
Aynı katılımcılardan alınan iki ölçümü fark puanlarının işaretli sıralarına göre karşılaştırır; fark puanlarının normal dağılmasını gerektirmez.
Yöntem özeti
Wilcoxon işaretli sıralar testi, eşleştirilmiş iki ölçüm arasındaki farkları alır, mutlak büyüklüklerine göre sıralar ve bu sıraları farkın işaretine göre toplar. Pozitif ve negatif yöndeki sıra toplamları birbirine yakınsa değişim yoktur; biri belirgin biçimde ağır basıyorsa ölçümler arasında sistematik bir kayma var demektir. Fark puanlarının kendisi değil sıraları kullanıldığı için, eşleştirilmiş t-testinin normallik varsayımının zorlandığı küçük örneklemlerde ve sıralı ölçeklerde tercih edilir. Sıfır farklar varsayılan ayarda sıralamadan çıkarılır. Motor, sıra tablosunun yanında Z değerini, asimptotik p değerini ve etki büyüklüğü olarak r katsayısını verir.
Hangi araştırma sorularında kullanılır?
- Eğitim öncesi ve sonrası alınan beş basamaklı özgüven değerlendirmesi değişti mi?
- Aynı katılımcıların iki ürün örneğine verdiği beğeni sıralaması farklı mı?
- Küçük bir örneklemde müdahale öncesi ve sonrası semptom şiddeti puanları ayrışıyor mu?
- Aynı kullanıcıların eski ve yeni arayüzde bildirdiği zorluk düzeyi değişiyor mu?
Ne zaman kullanılmalıdır?
- Aynı kişiden ya da eşleştirilmiş çiftlerden iki ölçüm alındığında.
- Fark puanlarının dağılımı normallikten belirgin biçimde uzaklaştığında.
- Ölçüm sıralı bir ölçekte yapıldığında ve ortalama farkı yorumlamak savunulabilir olmadığında.
- Örneklem küçükken ve birkaç aykırı değerin ortalamayı sürüklediği durumlarda.
Gerekli değişken türleri
- İki sütun: aynı katılımcının birinci ve ikinci ölçümü, sayısal olarak kodlanmış.
- Satırlar eşleştirilmiş gözlemleri temsil eder; her satır bir katılımcı ya da bir eşleştirilmiş çifttir.
- En az altı eksiksiz çift; motor bunun altında analizi çalıştırmaz.
Temel varsayımlar
- Ölçümlerin eşleştirilmiş olması
- İki sütun aynı katılımcının ya da eşleştirilmiş çiftin ölçümleri olmalıdır. Bağımsız gruplar için bu test geçerli değildir.
- Fark puanlarının sıralanabilir olması
- Farkların mutlak büyüklüklerinin anlamlı biçimde sıralanabilmesi gerekir; sıralanamayan kategorik kodlamalarda test anlamsızdır.
- Yeterli sayıda eşleştirilmiş gözlem
- Sıra toplamlarının anlamlı bir dağılıma yaklaşabilmesi için yeterli sayıda çift gerekir.
- Fark dağılımının bakışımlılığı
- Sonucu medyan farkı olarak yorumlamak istiyorsanız fark puanlarının dağılımının kabaca bakışımlı olması beklenir. Bakışım yoksa test, farkların genel eğilimi hakkında konuşur.
YouReply bu varsayımları nasıl kontrol eder?
- Ölçümlerin eşleştirilmiş olması: Panel bu varsayımı otomatik denetlemez; değerlendirme araştırmacıya aittir.
- Fark puanlarının sıralanabilir olması: Yöntem seçici iki sayısal sütun ister ve aynı sütunun iki alanda birden seçilmesini engeller.
- Yeterli sayıda eşleştirilmiş gözlem: Motor en az altı eksiksiz çift arar. Ayrıca Z değeri, sıfırdan farklı fark sayısı ondan küçükse hesaplanmaz ve sıfır olarak raporlanır; böyle bir durumda p değerini ihtiyatla okuyun.
- Fark dağılımının bakışımlılığı: Panel bakışımlılığı denetlemez. Motor sütun başına bir Kolmogorov-Smirnov normallik denetimi raporlar; bu denetim bilgilendirme amaçlıdır ve testin çalışmasını değiştirmez.
Analiz nasıl yürütülür?
- 1İki ölçümü ayrı sütunlar hâlinde içeren veri dosyanızı panele yükleyin.
- 2Değişken sekmesinde her iki sütunun da sayısal okunduğunu ve eksik değerlerin doğru işaretlendiğini doğrulayın.
- 3Analiz sekmesinde yöntem seçiciden Wilcoxon işaretli sıralar testini seçin.
- 4Parametre formunda birinci ve ikinci ölçüm sütunlarını belirtin; gerekirse sıfır farkların ele alınma biçimini değiştirin.
- 5Analizi çalıştırın; sıra tablosu, Z değeri, p değeri, etki büyüklüğü ve normallik denetimi ayrı başlıklarda açılır.
- 6Sonuçları Excel olarak indirin; künye kartı hangi kütüphane çağrısının kullanıldığını gösterir.
Üretilen istatistikler ve tablolar
- İşaretli sıra tablosu
- Negatif, pozitif ve eşit farkların sayısı ile ortalama sıra ve sıra toplamları; değişimin yönü bu tablodan okunur.
- Z değeri
- Standartlaştırılmış test istatistiği. Sıfırdan farklı fark sayısı ondan azsa hesaplanmaz ve sıfır olarak görünür.
- Asimptotik p değeri
- Seçilen sınama yönüne göre iki ya da tek yönlü olarak raporlanır.
- Etki büyüklüğü r
- Z değerinin gözlem sayısının kareköküne bölünmesiyle elde edilir ve büyüklüğünü niteleyen bir etiketle sunulur.
- Kolmogorov-Smirnov normallik denetimi
- Her sütun için ayrı bir tablo; Monte Carlo benzetimiyle elde edilen p değeri ve o benzetimin belirsizliğini gösteren aralık burada raporlanır.
Etki büyüklüğü ve güven aralığı
- r katsayısı
- Z değerinin örneklem büyüklüğüne göre ölçeklenmiş hâli. Yaklaşık 0,1 küçük, 0,3 orta, 0,5 ve üzeri büyük etki olarak yorumlanır; bu eşikler alan yazındaki gelenekten gelir, mutlak sınır değildir.
Fark puanlarının medyanı ya da etki büyüklüğü için güven aralığı döndürülmez. Sonuçta görünen yüzde 99'luk aralık, normallik denetiminde kullanılan Monte Carlo benzetiminin kendi belirsizliğine aittir; etkinin aralığı olarak raporlanmamalıdır.
Örnek araştırma sorusu ve örnek sonuç
Aşağıdaki sayılar temsili bir örnektir; gerçek bir araştırmanın ya da gerçek bir kullanıcının verisi değildir.
- Araştırma sorusu
- Bir eğitim programında, katılımcıların program öncesi ve sonrası bildirdiği uygulama becerisi düzeyi (1-7) değişti mi?
- Değişkenler
- Birinci ölçüm: program öncesi beceri düzeyi (sıralı) · İkinci ölçüm: program sonrası beceri düzeyi (sıralı)
- Örnek sonuç
- Otuz sekiz katılımcının 26'sında artış, 7'sinde azalış, 5'inde değişim yok. Z = -3,41, p = 0,001, r = 0,55.
- Yorum
- Artış yönündeki sıra toplamı belirgin biçimde ağır basıyor; program sonrasında bildirilen beceri düzeyi sistematik olarak yükselmiş görünüyor. Etki büyüklüğü yüksek, ancak kontrol grubu bulunmayan bir öncesi-sonrası tasarımında bu değişimi tek başına programa bağlamak mümkün değildir.
Örnek veri setiyle gerçek çıktı
Aşağıdaki sonuçları analiz motoru bu veri dosyasını çözümleyerek üretti. Değişkeni değiştirdiğinizde araştırma sorusu da değişiyor; sonuçların tamamı önceden hesaplandı, sayfa motora istek göndermiyor.
Genel müşteri anketi (sentetik)
Üç yüz yanıtlayıcılı geniş bir anket: iki ve üç kategorili gruplayıcılar, sürekli ölçümler, beşli sıralı ölçek, iki kategorili satın alma sonucu, dört kategorili marka tercihi, üç tekrarlı ölçüm, eşleştirilmiş ikili sorular, üç kodlayıcı, dört fiyat sorusu ve kasıtlı olarak boş bırakılmış hücreler.
- Satır sayısı
- 300
- Sütunlar
- katilimci_no, cinsiyet, egitim_duzeyi, bolge, yas, gelir, memnuniyet, hizmet_puani, fiyat_puani, kalite_puani, baglilik, tavsiye_skoru, satin_aldi, marka_tercihi, memnuniyet_duzeyi, on_puan, son_puan, olcum_1, olcum_2, olcum_3, kullanim_once, kullanim_sonra, kullanim_izleme, kodlayici_1, kodlayici_2, kodlayici_3, fiyat_cok_ucuz, fiyat_ucuz, fiyat_pahali, fiyat_cok_pahali, geri_bildirim_puani, izleme_puani
Veri sentetiktir: gerçek bir araştırmadan değil, sabit bir tohumla üretildi. Aşağıdaki değerleri analiz motoru bu dosyayı çözümleyerek üretti; aynı dosyayı panele yükleyince aynı sonuçları görürsünüz.
Araştırma sorusu: Aynı katılımcıların puanı sonraki ölçümde yükseldi mi?
- Birinci değişken
- on_puan
- İkinci değişken
- son_puan
Tek örneklem Kolmogorov-Smirnov testi
| Satır | Örneklem büyüklüğü | Normal dağılım parametreleri | En büyük sapmalar | Test istatistiği | Asimptotik p değeri (iki yönlü) | Monte Carlo p değeri (iki yönlü) |
|---|---|---|---|---|---|---|
| on_puan | 300 | - | - | 0,046 | 0,548 | - |
| son_puan | 300 | - | - | 0,042 | 0,660 | - |
Sıralar
| Satır | Negatif sıralar | Pozitif sıralar | Bağlı sıralar | Toplam |
|---|---|---|---|---|
| Sample Size | 63 | 236 | 1 | 300 |
| Mean Rank | 95,98 | 164,42 | - | - |
| Sum of Ranks | 6.046,50 | 38.803,50 | - | - |
Test istatistikleri
| Satır | on_puan - son_puan karşılaştırması |
|---|---|
| Z | -10,95 |
| Asymptotic Significance (2-tailed) (p) | < 0,001 |
Etki büyüklüğü
- Etki büyüklüğü r
- -0,632
Hesaplama künyesi: scipy 1.18.0 · statsmodels 0.14.6 · scikit-learn 1.9.0 · numpy 2.5.1 · pandas 3.0.5 · semopy 2.3.11 · 89fc29a · Veri tohumu: 20260914
Sonuç nasıl raporlanır?
Program sonrası bildirilen beceri düzeyi program öncesine göre anlamlı biçimde yükseldi, Z = -3,41, p = 0,001, r = 0,55 (26 artış, 7 azalış, 5 değişim yok).
APA düzenine yakın örnek cümle; sayılar temsilidir.
Ne zaman kullanılmamalıdır?
- Bağımsız gruplarda kullanılmaz; o tasarımda Mann-Whitney U testi gerekir.
- İkiden çok tekrarlı ölçüm varsa uygun değildir; tekrarlı ölçümler için başka yöntemler gerekir.
- Çok sayıda sıfır fark bulunduğunda değerlendirilen çift sayısı azalır ve testin gücü düşer.
- Fark dağılımı belirgin biçimde çarpıksa sonuç medyan farkı olarak yorumlanamaz.
- Kontrol grubu olmayan öncesi-sonrası tasarımlarda anlamlı bir sonuç nedensellik göstermez; zaman içindeki başka etkiler dışlanamaz.
Varsayımlar karşılanmazsa kullanılabilecek yöntemler
- Eşleştirilmiş Örneklem t-TestiNeden: Fark puanları yaklaşık normal dağılıyorsa; ortalama farkı ve onun yorumunu doğrudan verir.
- Mann-Whitney U TestiNeden: Karşılaştırılan iki ölçüm aynı kişilerden değil, farklı gruplardan geliyorsa.
- Friedman TestiNeden: Aynı katılımcılardan üç ya da daha fazla tekrarlı ölçüm alındıysa; sıralama mantığını çok ölçüme genişletir.
Sık sorulan sorular
- Sıfır farklar nasıl işleniyor?
- Varsayılan ayarda sıfır farklar sıralamadan çıkarılır ve sıra tablosunda ayrı bir satırda sayılır. Panelde bu davranışı değiştiren bir seçenek vardır; hangi ayarı kullandığınızı raporlamanız beklenir.
- Z değeri sıfır göründü, ne anlama geliyor?
- Sıfırdan farklı fark sayısı ondan azsa motor normal yaklaşıklığı kullanmaz ve Z alanını sıfır olarak döndürür. Böyle durumlarda p değerini sıra tablosuyla birlikte ihtiyatla değerlendirin, örneklemi büyütmeyi düşünün.
- Sonuçtaki yüzde 99'luk aralık etkinin güven aralığı mı?
- Hayır. O aralık, normallik denetiminde kullanılan Monte Carlo benzetiminin p değerine ilişkin belirsizliği gösterir. Etki büyüklüğü ya da medyan farkı için bir aralık hesaplanmaz.
- Eşleştirilmiş t-testi yerine bunu ne zaman seçmeliyim?
- Fark puanları belirgin biçimde çarpıksa, birkaç aykırı değer ortalamayı sürüklüyorsa ya da ölçüm tek bir sıralı maddeyse bu test daha savunulabilir. Fark puanları makul biçimde bakışımlıysa eşleştirilmiş t-testi daha güçlüdür.
Kaynaklar
- Siegel, S., & Castellan, N. J. (1988). Nonparametric Statistics for the Behavioral Sciences
- Field, A. (2018). Discovering Statistics Using IBM SPSS Statistics
- scipy.stats.wilcoxon belgeleri
Kendi verinizle deneyin
Ücretsiz planda ayda 50 analiz koşusu vardır; kart istenmez.