Grup karşılaştırma

Wilcoxon İşaretli Sıralar Testi

Aynı katılımcılardan alınan iki ölçümü fark puanlarının işaretli sıralarına göre karşılaştırır; fark puanlarının normal dağılmasını gerektirmez.

Yöntem özeti

Wilcoxon işaretli sıralar testi, eşleştirilmiş iki ölçüm arasındaki farkları alır, mutlak büyüklüklerine göre sıralar ve bu sıraları farkın işaretine göre toplar. Pozitif ve negatif yöndeki sıra toplamları birbirine yakınsa değişim yoktur; biri belirgin biçimde ağır basıyorsa ölçümler arasında sistematik bir kayma var demektir. Fark puanlarının kendisi değil sıraları kullanıldığı için, eşleştirilmiş t-testinin normallik varsayımının zorlandığı küçük örneklemlerde ve sıralı ölçeklerde tercih edilir. Sıfır farklar varsayılan ayarda sıralamadan çıkarılır. Motor, sıra tablosunun yanında Z değerini, asimptotik p değerini ve etki büyüklüğü olarak r katsayısını verir.

Hangi araştırma sorularında kullanılır?

  • Eğitim öncesi ve sonrası alınan beş basamaklı özgüven değerlendirmesi değişti mi?
  • Aynı katılımcıların iki ürün örneğine verdiği beğeni sıralaması farklı mı?
  • Küçük bir örneklemde müdahale öncesi ve sonrası semptom şiddeti puanları ayrışıyor mu?
  • Aynı kullanıcıların eski ve yeni arayüzde bildirdiği zorluk düzeyi değişiyor mu?

Ne zaman kullanılmalıdır?

  • Aynı kişiden ya da eşleştirilmiş çiftlerden iki ölçüm alındığında.
  • Fark puanlarının dağılımı normallikten belirgin biçimde uzaklaştığında.
  • Ölçüm sıralı bir ölçekte yapıldığında ve ortalama farkı yorumlamak savunulabilir olmadığında.
  • Örneklem küçükken ve birkaç aykırı değerin ortalamayı sürüklediği durumlarda.

Gerekli değişken türleri

  • İki sütun: aynı katılımcının birinci ve ikinci ölçümü, sayısal olarak kodlanmış.
  • Satırlar eşleştirilmiş gözlemleri temsil eder; her satır bir katılımcı ya da bir eşleştirilmiş çifttir.
  • En az altı eksiksiz çift; motor bunun altında analizi çalıştırmaz.

Temel varsayımlar

Ölçümlerin eşleştirilmiş olması
İki sütun aynı katılımcının ya da eşleştirilmiş çiftin ölçümleri olmalıdır. Bağımsız gruplar için bu test geçerli değildir.
Fark puanlarının sıralanabilir olması
Farkların mutlak büyüklüklerinin anlamlı biçimde sıralanabilmesi gerekir; sıralanamayan kategorik kodlamalarda test anlamsızdır.
Yeterli sayıda eşleştirilmiş gözlem
Sıra toplamlarının anlamlı bir dağılıma yaklaşabilmesi için yeterli sayıda çift gerekir.
Fark dağılımının bakışımlılığı
Sonucu medyan farkı olarak yorumlamak istiyorsanız fark puanlarının dağılımının kabaca bakışımlı olması beklenir. Bakışım yoksa test, farkların genel eğilimi hakkında konuşur.

YouReply bu varsayımları nasıl kontrol eder?

  • Ölçümlerin eşleştirilmiş olması: Panel bu varsayımı otomatik denetlemez; değerlendirme araştırmacıya aittir.
  • Fark puanlarının sıralanabilir olması: Yöntem seçici iki sayısal sütun ister ve aynı sütunun iki alanda birden seçilmesini engeller.
  • Yeterli sayıda eşleştirilmiş gözlem: Motor en az altı eksiksiz çift arar. Ayrıca Z değeri, sıfırdan farklı fark sayısı ondan küçükse hesaplanmaz ve sıfır olarak raporlanır; böyle bir durumda p değerini ihtiyatla okuyun.
  • Fark dağılımının bakışımlılığı: Panel bakışımlılığı denetlemez. Motor sütun başına bir Kolmogorov-Smirnov normallik denetimi raporlar; bu denetim bilgilendirme amaçlıdır ve testin çalışmasını değiştirmez.

Analiz nasıl yürütülür?

  1. 1İki ölçümü ayrı sütunlar hâlinde içeren veri dosyanızı panele yükleyin.
  2. 2Değişken sekmesinde her iki sütunun da sayısal okunduğunu ve eksik değerlerin doğru işaretlendiğini doğrulayın.
  3. 3Analiz sekmesinde yöntem seçiciden Wilcoxon işaretli sıralar testini seçin.
  4. 4Parametre formunda birinci ve ikinci ölçüm sütunlarını belirtin; gerekirse sıfır farkların ele alınma biçimini değiştirin.
  5. 5Analizi çalıştırın; sıra tablosu, Z değeri, p değeri, etki büyüklüğü ve normallik denetimi ayrı başlıklarda açılır.
  6. 6Sonuçları Excel olarak indirin; künye kartı hangi kütüphane çağrısının kullanıldığını gösterir.

Üretilen istatistikler ve tablolar

İşaretli sıra tablosu
Negatif, pozitif ve eşit farkların sayısı ile ortalama sıra ve sıra toplamları; değişimin yönü bu tablodan okunur.
Z değeri
Standartlaştırılmış test istatistiği. Sıfırdan farklı fark sayısı ondan azsa hesaplanmaz ve sıfır olarak görünür.
Asimptotik p değeri
Seçilen sınama yönüne göre iki ya da tek yönlü olarak raporlanır.
Etki büyüklüğü r
Z değerinin gözlem sayısının kareköküne bölünmesiyle elde edilir ve büyüklüğünü niteleyen bir etiketle sunulur.
Kolmogorov-Smirnov normallik denetimi
Her sütun için ayrı bir tablo; Monte Carlo benzetimiyle elde edilen p değeri ve o benzetimin belirsizliğini gösteren aralık burada raporlanır.

Etki büyüklüğü ve güven aralığı

r katsayısı
Z değerinin örneklem büyüklüğüne göre ölçeklenmiş hâli. Yaklaşık 0,1 küçük, 0,3 orta, 0,5 ve üzeri büyük etki olarak yorumlanır; bu eşikler alan yazındaki gelenekten gelir, mutlak sınır değildir.

Fark puanlarının medyanı ya da etki büyüklüğü için güven aralığı döndürülmez. Sonuçta görünen yüzde 99'luk aralık, normallik denetiminde kullanılan Monte Carlo benzetiminin kendi belirsizliğine aittir; etkinin aralığı olarak raporlanmamalıdır.

Örnek araştırma sorusu ve örnek sonuç

Aşağıdaki sayılar temsili bir örnektir; gerçek bir araştırmanın ya da gerçek bir kullanıcının verisi değildir.

Araştırma sorusu
Bir eğitim programında, katılımcıların program öncesi ve sonrası bildirdiği uygulama becerisi düzeyi (1-7) değişti mi?
Değişkenler
Birinci ölçüm: program öncesi beceri düzeyi (sıralı) · İkinci ölçüm: program sonrası beceri düzeyi (sıralı)
Örnek sonuç
Otuz sekiz katılımcının 26'sında artış, 7'sinde azalış, 5'inde değişim yok. Z = -3,41, p = 0,001, r = 0,55.
Yorum
Artış yönündeki sıra toplamı belirgin biçimde ağır basıyor; program sonrasında bildirilen beceri düzeyi sistematik olarak yükselmiş görünüyor. Etki büyüklüğü yüksek, ancak kontrol grubu bulunmayan bir öncesi-sonrası tasarımında bu değişimi tek başına programa bağlamak mümkün değildir.

Örnek veri setiyle gerçek çıktı

Aşağıdaki sonuçları analiz motoru bu veri dosyasını çözümleyerek üretti. Değişkeni değiştirdiğinizde araştırma sorusu da değişiyor; sonuçların tamamı önceden hesaplandı, sayfa motora istek göndermiyor.

Genel müşteri anketi (sentetik)

Üç yüz yanıtlayıcılı geniş bir anket: iki ve üç kategorili gruplayıcılar, sürekli ölçümler, beşli sıralı ölçek, iki kategorili satın alma sonucu, dört kategorili marka tercihi, üç tekrarlı ölçüm, eşleştirilmiş ikili sorular, üç kodlayıcı, dört fiyat sorusu ve kasıtlı olarak boş bırakılmış hücreler.

Satır sayısı
300
Sütunlar
katilimci_no, cinsiyet, egitim_duzeyi, bolge, yas, gelir, memnuniyet, hizmet_puani, fiyat_puani, kalite_puani, baglilik, tavsiye_skoru, satin_aldi, marka_tercihi, memnuniyet_duzeyi, on_puan, son_puan, olcum_1, olcum_2, olcum_3, kullanim_once, kullanim_sonra, kullanim_izleme, kodlayici_1, kodlayici_2, kodlayici_3, fiyat_cok_ucuz, fiyat_ucuz, fiyat_pahali, fiyat_cok_pahali, geri_bildirim_puani, izleme_puani
Veri setini CSV olarak indir

Veri sentetiktir: gerçek bir araştırmadan değil, sabit bir tohumla üretildi. Aşağıdaki değerleri analiz motoru bu dosyayı çözümleyerek üretti; aynı dosyayı panele yükleyince aynı sonuçları görürsünüz.

Araştırma sorusu: Aynı katılımcıların puanı sonraki ölçümde yükseldi mi?

Birinci değişken
on_puan
İkinci değişken
son_puan

Tek örneklem Kolmogorov-Smirnov testi

Tek örneklem Kolmogorov-Smirnov testi
SatırÖrneklem büyüklüğüNormal dağılım parametreleriEn büyük sapmalarTest istatistiğiAsimptotik p değeri (iki yönlü)Monte Carlo p değeri (iki yönlü)
on_puan300--0,0460,548-
son_puan300--0,0420,660-

Sıralar

Sıralar
SatırNegatif sıralarPozitif sıralarBağlı sıralarToplam
Sample Size632361300
Mean Rank95,98164,42--
Sum of Ranks6.046,5038.803,50--

Test istatistikleri

Test istatistikleri
Satıron_puan - son_puan karşılaştırması
Z-10,95
Asymptotic Significance (2-tailed) (p)< 0,001

Etki büyüklüğü

Etki büyüklüğü r
-0,632

Hesaplama künyesi: scipy 1.18.0 · statsmodels 0.14.6 · scikit-learn 1.9.0 · numpy 2.5.1 · pandas 3.0.5 · semopy 2.3.11 · 89fc29a · Veri tohumu: 20260914

Sonuç nasıl raporlanır?

Program sonrası bildirilen beceri düzeyi program öncesine göre anlamlı biçimde yükseldi, Z = -3,41, p = 0,001, r = 0,55 (26 artış, 7 azalış, 5 değişim yok).

APA düzenine yakın örnek cümle; sayılar temsilidir.

Ne zaman kullanılmamalıdır?

  • Bağımsız gruplarda kullanılmaz; o tasarımda Mann-Whitney U testi gerekir.
  • İkiden çok tekrarlı ölçüm varsa uygun değildir; tekrarlı ölçümler için başka yöntemler gerekir.
  • Çok sayıda sıfır fark bulunduğunda değerlendirilen çift sayısı azalır ve testin gücü düşer.
  • Fark dağılımı belirgin biçimde çarpıksa sonuç medyan farkı olarak yorumlanamaz.
  • Kontrol grubu olmayan öncesi-sonrası tasarımlarda anlamlı bir sonuç nedensellik göstermez; zaman içindeki başka etkiler dışlanamaz.

Varsayımlar karşılanmazsa kullanılabilecek yöntemler

  • Eşleştirilmiş Örneklem t-TestiNeden: Fark puanları yaklaşık normal dağılıyorsa; ortalama farkı ve onun yorumunu doğrudan verir.
  • Mann-Whitney U TestiNeden: Karşılaştırılan iki ölçüm aynı kişilerden değil, farklı gruplardan geliyorsa.
  • Friedman TestiNeden: Aynı katılımcılardan üç ya da daha fazla tekrarlı ölçüm alındıysa; sıralama mantığını çok ölçüme genişletir.

Sık sorulan sorular

Sıfır farklar nasıl işleniyor?
Varsayılan ayarda sıfır farklar sıralamadan çıkarılır ve sıra tablosunda ayrı bir satırda sayılır. Panelde bu davranışı değiştiren bir seçenek vardır; hangi ayarı kullandığınızı raporlamanız beklenir.
Z değeri sıfır göründü, ne anlama geliyor?
Sıfırdan farklı fark sayısı ondan azsa motor normal yaklaşıklığı kullanmaz ve Z alanını sıfır olarak döndürür. Böyle durumlarda p değerini sıra tablosuyla birlikte ihtiyatla değerlendirin, örneklemi büyütmeyi düşünün.
Sonuçtaki yüzde 99'luk aralık etkinin güven aralığı mı?
Hayır. O aralık, normallik denetiminde kullanılan Monte Carlo benzetiminin p değerine ilişkin belirsizliği gösterir. Etki büyüklüğü ya da medyan farkı için bir aralık hesaplanmaz.
Eşleştirilmiş t-testi yerine bunu ne zaman seçmeliyim?
Fark puanları belirgin biçimde çarpıksa, birkaç aykırı değer ortalamayı sürüklüyorsa ya da ölçüm tek bir sıralı maddeyse bu test daha savunulabilir. Fark puanları makul biçimde bakışımlıysa eşleştirilmiş t-testi daha güçlüdür.

Kaynaklar

  • Siegel, S., & Castellan, N. J. (1988). Nonparametric Statistics for the Behavioral Sciences
  • Field, A. (2018). Discovering Statistics Using IBM SPSS Statistics
  • scipy.stats.wilcoxon belgeleri

Kendi verinizle deneyin

Ücretsiz planda ayda 50 analiz koşusu vardır; kart istenmez.