Apa yang dijawab uji t
Ia menanyakan satu hal yang sempit: kalau kedua kelompok benar-benar punya rata-rata yang sama, seberapa sering pengambilan sampel acak akan menghasilkan selisih setidaknya sebesar yang Anda ukur? Itulah nilai p. Itu bukan peluang bahwa hipotesis Anda benar.
Memilih yang tepat
- Berpasangan: subjek yang sama diukur dua kali, sebelum dan sesudah. Yang diuji adalah selisihnya, sehingga ragam antar subjek hilang dan uji ini jauh lebih sensitif. Pakai ini setiap kali datanya benar-benar berpasangan.
- Welch dua sampel: dua kelompok bebas, tanpa mengandaikan ragamnya sama. Ini pilihan baku yang masuk akal untuk kelompok bebas.
- Student dua sampel: sama, tetapi ragamnya digabungkan. Hanya sepadan kalau ukuran dan sebaran kedua kelompok mirip, dan keuntungannya atas Welch sangat kecil.
- Satu sampel: satu kelompok terhadap satu nilai acuan tetap.
Contoh perhitungan
Kelompok A: 5,1, 5,3, 4,9, 5,0, 5,2. Kelompok B: 4,5, 4,7, 4,3, 4,4, 4,6.
- Rata-rata 5,10 dan 4,50, masing-masing dengan simpangan baku 0,158.
- Galat baku selisihnya: √(0,025/5 + 0,025/5) = 0,1.
- t = 0,60 ÷ 0,1 = 6,00, dengan 8 derajat kebebasan.
- p = 0,00032 dua sisi.
Selisih sebesar itu antara dua kelompok lima data yang serapat ini akan muncul karena kebetulan sekitar tiga kali dari sepuluh ribu.
Satu sisi atau dua sisi
Pakai dua sisi kecuali selisih pada satu arah tidak berarti apa-apa bagi Anda, dan tentukan sebelum melihat datanya. Berpindah ke satu sisi sesudahnya agar turun di bawah 0,05 memotong nilai p jadi separuh secara gratis, dan itu cara paling umum uji ini disalahgunakan.
Apa yang diandaikan uji ini
- Pengamatan yang saling bebas. Inilah pengandaian yang paling sering dilanggar, dan tidak ada uji yang bisa menyelamatkannya. Pengukuran berulang pada subjek yang sama tidak saling bebas.
- Data yang kurang lebih normal, atau cukup banyak. Di atas sekitar 30 per kelompok uji ini tahan terhadap ketaknormalan; di bawahnya, kemiringan kuat atau pencilan jadi penting.
- Tidak ada pengandaian ragam sama, kalau Anda memakai Welch.
Sampel kecil yang jelas miring lebih cocok ditangani Mann-Whitney atau Wilcoxon.
Laporkan juga ukuran efeknya
Nilai p tidak mengatakan apa pun tentang besarnya selisih. Dengan sampel besar, selisih yang tidak berarti bisa jadi signifikan; dengan sampel kecil, selisih besar bisa tidak signifikan. Sebutkan selisih rata-rata beserta selang kepercayaannya, dan d Cohen (selisih ÷ simpangan baku gabungan, dengan 0,2 kecil, 0,5 sedang, dan 0,8 besar). Pada contoh di atas d bernilai 3,8, yang sangat besar.
Alat
Kalkulator Uji t menjalankan uji berpasangan, dua sampel, dan Welch, serta memberi t, derajat kebebasan, dan nilai p. Kalkulator Simpangan Baku memberi rata-rata dan sebaran setiap kelompok secara terpisah.