Kategorik

Cochran Q Testi

Aynı katılımcılarda ölçülen üç ya da daha fazla evet hayır maddesinin kabul oranlarının birbirinden anlamlı biçimde ayrılıp ayrılmadığını tek bir sınamada değerlendirir.

Yöntem özeti

Cochran Q testi, iki eşleştirilmiş ikili ölçümle sınırlı kalan McNemar mantığını üç ve daha fazla sütuna taşır. Tipik kullanımı iki biçimdedir: aynı katılımcıların birkaç evet hayır maddesine verdiği yanıtlar, örneğin bir listedeki hizmetlerden hangilerini kullandıkları; ya da tek bir maddenin üç ve daha fazla zaman noktasında yinelenen ölçümü. Hesap her katılımcıyı kendi içinde değerlendirir: tüm maddelere evet diyen ya da hiçbirine evet demeyen katılımcılar sütunlar arası farka bilgi taşımaz, ayrışma yanıt örüntüsü karışık olan kişilerden gelir. Q istatistiği sütunların evet sayılarının birbirinden ne kadar uzaklaştığını, katılımcıların kendi toplam evet sayılarına göre ölçeklendirerek özetler ve sütun sayısının bir eksiği kadar serbestlik derecesiyle ki-kare dağılımına karşı değerlendirilir. Sonuç tek bir genel yargıdır: en az bir sütun ötekilerden ayrışıyor mu. YouReply Nicel Analiz Q değerini, serbestlik derecesini, p değerini ve her sütun için evet sayısını ya da oranını raporlar.

Hangi araştırma sorularında kullanılır?

  • Listelenen dört dijital hizmetin kullanım oranları aynı katılımcı kümesi içinde birbirinden ayrılıyor mu?
  • Bir kurala uyma oranı üç ardışık ölçüm dalgası boyunca sabit mi kaldı?
  • Katılımcıların beş farklı bilgi kaynağına duyduğu güven, evet hayır biçiminde sorulduğunda eşit düzeyde mi?
  • Aynı kişilere sunulan üç ambalaj seçeneği için verilen satın alma niyeti yanıtlarının kabul oranları farklılaşıyor mu?

Ne zaman kullanılmalıdır?

  • Üç ya da daha fazla ikili sütun varsa ve bu sütunların hepsi aynı katılımcılarda ölçülmüşse.
  • Bir maddenin üç ve daha fazla zaman noktasındaki ölçümü karşılaştırılacaksa ve yanıt evet hayır biçimindeyse.
  • Çoklu yanıtlı bir soruda işaretlenen seçeneklerin kabul oranlarının birbirinden ayrışıp ayrışmadığı sorulduğunda.
  • Önce genel bir sınama yapıp ardından gerekiyorsa ikili karşılaştırmalara geçmeyi planlıyorsanız.
  • Bağımsız gruplar değil, aynı kişilerin yinelenen ikili yanıtları karşılaştırılıyorsa.

Gerekli değişken türleri

  • Üç ya da daha fazla sütun; her biri aynı iki düzeyi, örneğin 1 ile 0 ya da işaretlendi ile işaretlenmedi biçiminde taşımalıdır.
  • Bütün sütunlarda kodlama birebir aynı olmalıdır; bir sütunda boş hücreyle, bir başkasında sıfırla gösterilen hayır yanıtı iki farklı şey gibi okunur.
  • Her satır tek bir katılımcıyı göstermelidir, böylece sütunlar arası karşılaştırma kişinin kendi içinde yapılabilir.
  • Sütun sayısı ikide kalıyorsa bu yöntem yerine eşleştirilmiş ikili ölçümler için tanımlanmış iki sütunluk sınama kullanılır.
  • Sürekli ya da çok kategorili ölçümler bu testin girdisi olamaz; ikiliye indirme Değişken sekmesindeki türetilmiş sütunlarla yapılır ve indirgeme kararı raporlanmalıdır.

Temel varsayımlar

Bütün sütunların aynı katılımcılardan gelmesi
Karşılaştırılan sütunlar aynı kişilerde ölçülmüş olmalıdır. Farklı kişilere farklı maddeler sorulduğunda satır içi karşılaştırma kurulamaz ve Q yanlış bir soruyu yanıtlar.
Katılımcıların birbirinden bağımsızlığı
Bir katılımcının sütunları arasındaki bağ tasarımın gereğidir, ancak iki ayrı katılımcı arasında böyle bir bağ bulunmamalıdır. Kümelenmiş örneklemlerde p değeri olduğundan küçük görünür.
Yanıtların iki düzeyli olması
Her sütun tam olarak iki düzeye indirgenmiş olmalıdır. Üç düzeyli bir yanıt ölçeği Q hesabına giremez.
Eksiksiz satırlar
Karşılaştırma satır içinde yürüdüğü için bir sütunda yanıtı olmayan katılımcı bütün sütunlardan çıkar. Bu, çok maddeli listelerde örneklemi belirgin biçimde daraltabilir.
Yeterli karışık örüntü
Bütün maddelere evet ya da hiçbirine evet demeyen katılımcılar sütun farklarına bilgi taşımaz. Örneklemin büyük bölümü bu iki uçta toplanmışsa test etkili biçimde küçük bir altkümeye dayanır.

YouReply bu varsayımları nasıl kontrol eder?

  • Bütün sütunların aynı katılımcılardan gelmesi: Eşleştirme veri dosyasının düzeninden geldiği için panel bunu doğrulayamaz; sütunların aynı satırda doğru kişiye denk geldiğini Veri sekmesinde siz denetlersiniz.
  • Katılımcıların birbirinden bağımsızlığı: Panel bu varsayımı otomatik denetlemez; değerlendirme araştırmacıya aittir.
  • Yanıtların iki düzeyli olması: Koşu sırasında sütunlar ikili olarak okunur; ikiden çok düzey bulunduğunda ya da bir sütun tek düzeye düştüğünde analiz yürümez.
  • Eksiksiz satırlar: Eksik yanıtı olan satırlar analiz dışında kalır ve kalan gözlem sayısı sonuçta görünür; kaybın neden oluştuğuna dair bir tanı üretilmez.
  • Yeterli karışık örüntü: Karışık örüntülü katılımcı sayısı için ayrı bir uyarı üretilmez. Sütun başına evet sayılarını okuyarak dağılımın ne kadar uç değerlere yığıldığını kendiniz değerlendirmeniz gerekir.

Analiz nasıl yürütülür?

  1. 1Dosyayı panele bırakın; sürükle bırak ile yüklenen CSV ya da XLSX dosyası Veri sekmesindeki ızgarada açılır.
  2. 2Izgarada karşılaştırılacak bütün ikili sütunları gözden geçirin; işaretlenmemiş seçeneklerin boş bırakıldığı bir dosyada bu boşlukların hayır mı kayıp mı olduğuna karar vermek gerekir.
  3. 3Değişken sekmesinde sütunların ölçüm düzeyini ve kayıp değer kodlarını tanımlayın; boşluğu hayır olarak okumak istiyorsanız bunu türetilmiş sütunla açıkça yapın.
  4. 4Analiz sekmesinde kategorik veri kategorisinden yöntemi seçin; veri gereksinimleri kutusu hangi sütunların ikili koşulu sağladığını gösterir.
  5. 5Parametre formunda karşılaştırılacak üç ya da daha fazla sütunu işaretleyip analizi çalıştırın.
  6. 6Sonuçta önce sütun başına evet sayılarını okuyun, sonra Q değerini, serbestlik derecesini ve p değerini açılır bölümlerden inceleyin; bu yöntem için grafik üretilmez.
  7. 7Anlamlı bir Q elde ettiyseniz ikili karşılaştırmaları ayrı koşular olarak planlayın, tabloları Excel olarak indirin ve koşu geçmişi sekmesinden hangi sütun kümesini kullandığınızı izleyin.

Üretilen istatistikler ve tablolar

Q istatistiği
Sütunların evet sayılarının birbirinden uzaklığını, katılımcıların kendi yanıt örüntülerine göre ölçeklendirerek özetleyen test istatistiği.
Serbestlik derecesi
Karşılaştırılan sütun sayısının bir eksiği. Dört maddeli bir listede serbestlik derecesi üçtür.
Anlamlılık değeri
Bütün sütunların kabul oranının eşit olduğu varsayımı altında ki-kare dağılımından hesaplanan p değeri. Sonuç genel bir yargıdır, hangi sütunun ayrıştığını söylemez.
Sütun başına evet sayıları ya da oranları
Her maddenin kaç katılımcı tarafından evet olarak işaretlendiği, gerektiğinde oran biçiminde verilir. Bulguyu anlatırken okuyucuya aktarılacak asıl betimleyici bilgi budur.
Analize giren gözlem sayısı
Bütün sütunlarda geçerli yanıtı bulunan katılımcı sayısı; madde sayısı arttıkça bu sayının dosyadaki satır sayısından uzaklaşması olağandır.

Etki büyüklüğü ve güven aralığı

Etki büyüklüğü hesaplanmaz
Sütunlar arası ayrışmanın büyüklüğünü veren bir katsayı döndürülmez. Bulgunun ağırlığını anlatmak için sütun başına evet oranlarını, en yüksek ve en düşük oran arasındaki puan farkını ve analize giren katılımcı sayısını birlikte raporlamanız gerekir. Tekrarlı ölçümlerde uyum derecesini özetleyen bir ölçü arıyorsanız bunu panel dışında hesaplamanız gerekir.

Bu yöntemde güven aralığı döndürülmez. Q değeri, serbestlik derecesi ve p değeri nokta sonuçlar olarak verilir; sütunların oranları için ya da sütunlar arasındaki farklar için aralık hesaplanmaz. Tek bir maddenin oranı için aralıklı tahmin istiyorsanız bunu oran testini tek örneklem kipinde ayrıca çalıştırarak alabilirsiniz.

Örnek araştırma sorusu ve örnek sonuç

Aşağıdaki sayılar temsili bir örnektir; gerçek bir araştırmanın ya da gerçek bir kullanıcının verisi değildir.

Araştırma sorusu
Temsili bir kamu hizmetleri araştırmasında, aynı katılımcılara sorulan üç dijital kanalın kullanım oranları birbirinden ayrılıyor mu?
Değişkenler
Birinci sütun: mobil uygulama kullanımı (evet, hayır) · İkinci sütun: internet sitesi kullanımı (evet, hayır) · Üçüncü sütun: telefonla hizmet alma (evet, hayır)
Örnek sonuç
Üç sütunda da yanıtı bulunan 150 katılımcı analize girdi. Evet sayıları mobil uygulamada 96, internet sitesinde 78, telefonda 61 oldu; oranlar sırasıyla yüzde 64,0, yüzde 52,0 ve yüzde 40,7. Katılımcıların 40'ı üç kanalın hepsini, 45'i ikisini, 25'i yalnız birini kullanıyor, 40'ı hiçbirini kullanmıyor. Test sonucu Q = 26,26, serbestlik derecesi 2, p < 0,001.
Yorum
Üç kanalın kullanım oranı eşit değil: en yüksek ile en düşük oran arasında 23,3 puanlık bir açıklık var ve bu açıklığın rastlantıyla doğması p değerine göre çok seyrek. Sonucun söylemediği şey hangi çiftin ayrıştığıdır: mobil uygulama ile internet sitesi arasındaki 12 puanlık farkın anlamlı olup olmadığı Q değerinden okunamaz. Bunu görmek için kanalları ikili ikili karşılaştıran eşleştirilmiş sınamaları ayrı koşular olarak yürütmek ve üç karşılaştırma için anlamlılık düzeyini düzeltmek gerekir. Ayrıca üç kanalın hepsini kullanan 40 kişi ile hiçbirini kullanmayan 40 kişi Q hesabına bilgi taşımaz; ayrışma kalan 70 katılımcının karışık örüntüsünden gelir. Sayılar temsilidir.

Örnek veri setiyle gerçek çıktı

Aşağıdaki sonuçları analiz motoru bu veri dosyasını çözümleyerek üretti. Değişkeni değiştirdiğinizde araştırma sorusu da değişiyor; sonuçların tamamı önceden hesaplandı, sayfa motora istek göndermiyor.

Genel müşteri anketi (sentetik)

Üç yüz yanıtlayıcılı geniş bir anket: iki ve üç kategorili gruplayıcılar, sürekli ölçümler, beşli sıralı ölçek, iki kategorili satın alma sonucu, dört kategorili marka tercihi, üç tekrarlı ölçüm, eşleştirilmiş ikili sorular, üç kodlayıcı, dört fiyat sorusu ve kasıtlı olarak boş bırakılmış hücreler.

Satır sayısı
300
Sütunlar
katilimci_no, cinsiyet, egitim_duzeyi, bolge, yas, gelir, memnuniyet, hizmet_puani, fiyat_puani, kalite_puani, baglilik, tavsiye_skoru, satin_aldi, marka_tercihi, memnuniyet_duzeyi, on_puan, son_puan, olcum_1, olcum_2, olcum_3, kullanim_once, kullanim_sonra, kullanim_izleme, kodlayici_1, kodlayici_2, kodlayici_3, fiyat_cok_ucuz, fiyat_ucuz, fiyat_pahali, fiyat_cok_pahali, geri_bildirim_puani, izleme_puani
Veri setini CSV olarak indir

Veri sentetiktir: gerçek bir araştırmadan değil, sabit bir tohumla üretildi. Aşağıdaki değerleri analiz motoru bu dosyayı çözümleyerek üretti; aynı dosyayı panele yükleyince aynı sonuçları görürsünüz.

Araştırma sorusu: Kullanım oranı üç ölçüm boyunca sabit mi kaldı?

Çözümlenen sütunlar
kullanim_once,kullanim_sonra,kullanim_izleme
q değeri
89,31
Serbestlik derecesi
2
p değeri
< 0,001
Geçerli gözlem
300
Anlamlı
Evet

Başarı oranları

kullanim_once
0,303
kullanim_sonra
0,553
kullanim_izleme
0,587

Hesaplama künyesi: scipy 1.18.0 · statsmodels 0.14.6 · scikit-learn 1.9.0 · numpy 2.5.1 · pandas 3.0.5 · semopy 2.3.11 · 89fc29a · Veri tohumu: 20260914

Sonuç nasıl raporlanır?

Üç dijital kanalın kullanım oranları arasında anlamlı fark bulundu, Cochran Q(2, N = 150) = 26,26, p < 0,001; kullanım oranları mobil uygulamada yüzde 64,0, internet sitesinde yüzde 52,0 ve telefonda yüzde 40,7 olarak ölçüldü.

APA düzenine yakın örnek cümle; sayılar temsilidir.

Ne zaman kullanılmamalıdır?

  • İzleme analizi döndürülmez: anlamlı bir Q, sütunlardan en az birinin ayrıştığını söyler ama hangi çiftin ayrıştığını göstermez.
  • İkili karşılaştırmalar elle kurulduğunda çoklu karşılaştırma düzeltmesi de elle uygulanmalıdır; düzeltmesiz bir tarama üç maddede bile yanlış pozitif riskini belirgin biçimde yükseltir.
  • Bütün maddelere aynı yanıtı veren katılımcılar hesaba bilgi taşımaz, bu yüzden yanıtların uçlarda yığıldığı listelerde test beklenenden duyarsız kalır.
  • Madde sayısı arttıkça eksiksiz satır bulma koşulu örneklemi daraltır; uzun listelerde analize giren kişi sayısı dosyadaki satır sayısının belirgin biçimde altına düşebilir.
  • Etki büyüklüğü ve güven aralığı döndürülmediği için raporlama tablosu yalnız istatistik ve p değeriyle tamamlanamaz.
  • Maddeler kavramsal olarak karşılaştırılabilir olmalıdır; biçimsel olarak hepsi ikili olsa da farklı şeyleri soran maddelerin kabul oranlarını tek bir sınamada eşitlemek yorum düzeyinde anlamsız kalır.

Varsayımlar karşılanmazsa kullanılabilecek yöntemler

  • McNemar TestiNeden: Karşılaştırılacak eşleştirilmiş ikili sütun sayısı ikiye indiğinde ya da anlamlı bir Q sonrasında çiftler tek tek sınanacağında.
  • Friedman TestiNeden: Tekrarlı ölçümler ikili değil sıralı ya da sürekliyse; sıralar üzerinden üç ve daha fazla ölçümü karşılaştırır.
  • Ki-Kare Bağımsızlık TestiNeden: Karşılaştırılan kümeler aynı kişiler değil bağımsız gruplarsa; kategorik iki değişken arasındaki ilişkiye bakar.
  • Çoklu Cevap AnaliziNeden: Çoklu yanıtlı bir soruda seçeneklerin işaretlenme sıklıklarını betimlemek anlamlılık sınamasından önce geliyorsa.

Sık sorulan sorular

Q anlamlı çıktı, hangi maddenin ayrıştığını nasıl bulurum?
Panel bu yöntemde izleme analizi çalıştırmaz: ikili karşılaştırmalar kendiliğinden yürütülmez ve düzeltilmiş p değerleri üretilmez. Pratik yol, ayrışmasını merak ettiğiniz sütun çiftlerini eşleştirilmiş ikili sınamayla ayrı koşularda karşılaştırmak ve ardından kaç karşılaştırma yaptığınızı hesaba katan bir düzeltme uygulamaktır. Üç maddede üç olası çift, dört maddede altı çift bulunduğunu unutmayın; karşılaştırma sayısı hızla artar ve her yeni koşu ücretsiz planın aylık elli koşu sınırından düşer.
Bütün maddelere evet diyen katılımcılar neden sonuca etki etmiyor?
Test sütunların birbirine göre konumunu her katılımcının kendi içinde değerlendirir. Bir kişi bütün maddelere evet dediğinde o kişi hiçbir sütunu diğerinden ayırmaz, dolayısıyla sütunlar arası farka bilgi taşımaz; aynısı hiçbirine evet demeyenler için geçerlidir. Bu yüzden sütun başına evet sayılarının yanında karışık örüntülü katılımcı sayısını da okumak gerekir: örneklemin büyük bölümü uçlarda toplanmışsa Q küçük bir altkümeye dayanıyor demektir.
Çoklu yanıtlı bir soruda boş bırakılan seçenekleri hayır sayabilir miyim?
Bu bir veri hazırlama kararıdır ve sonucu doğrudan etkiler. Katılımcı bütün listeyi gördüyse ve işaretlemediği seçenek bilinçli bir tercihse boşluğu hayır olarak kodlamak savunulabilir; liste sayfalara bölünmüşse ya da bazı katılımcılar soruyu atladıysa aynı boşluk kayıp değerdir. Kararı Değişken sekmesinde türetilmiş sütunla açık biçimde verin, çünkü boşlukları kayıp saymak eksiksiz satır koşulu yüzünden örneklemi daraltır, hayır saymak ise kabul oranlarını aşağı çeker.
Kaç madde karşılaştırabilirim?
Sınır madde sayısında değil, bütün maddelerde yanıtı bulunan katılımcı sayısındadır. Serbestlik derecesi madde sayısının bir eksiği olduğu için uzun listelerde testin gücü dağılır ve aynı anda artan eksiksiz satır koşulu örneklemi daraltır. Liste uzadıkça sonuç da yorumlanması güç bir genel yargıya dönüşür; yedi sekiz maddeyi tek sınamada eşitlemek yerine kavramsal olarak birbirine yakın maddeleri kümeleyip ayrı koşular kurmak daha okunur bir rapor verir.

Kaynaklar

Kendi verinizle deneyin

Ücretsiz planda ayda 50 analiz koşusu vardır; kart istenmez.