Materi
Ketika data berupa hitungan per kategori, misalnya jenis cacat produk menurut shift atau metode pembayaran menurut cabang, datanya disusun sebagai tabel kontingensi dengan r baris dan c kolom. Uji chi-kuadrat independensi menguji H0 bahwa kedua penggolongan itu saling bebas: proporsi tiap kategori kolom sama di setiap baris.
Uji ini membandingkan frekuensi teramati dengan frekuensi harapan, yaitu hitungan yang diharapkan bila H0 benar. Frekuensi harapan satu sel = total barisnya × total kolomnya ÷ total keseluruhan. Derajat bebasnya (r − 1) × (c − 1). Di scipy, stats.chi2_contingency(tabel) mengembalikan statistic, pvalue, dof, dan expected_freq. Untuk tabel 2 × 2, yang derajat bebasnya 1, fungsi itu menerapkan koreksi kontinuitas Yates secara bawaan; correction=False mematikannya.
Contoh dengan data lain: dua shift pabrik dan dua jenis cacat, shift pagi 20 goresan dan 30 penyok, shift malam 35 goresan dan 15 penyok. Total baris 50, total kolom goresan 55, total 100, sehingga frekuensi harapan sel pagi-goresan 50 × 55 ÷ 100 = 27,5.
from scipy import stats
tabel = [[20, 30], [35, 15]]
hasil = stats.chi2_contingency(tabel)
print(hasil.statistic, hasil.pvalue, hasil.dof)
print(hasil.expected_freq) # [[27.5 22.5] [27.5 22.5]]