Kalkulator Ukuran Sampel
Hasil
Ukuran sampel yang dibutuhkan
- Nilai kritis
- 1,9600
Kalkulator ukuran sampel ini menjawab pertanyaan yang datang sebelum surveinya: berapa banyak jawaban yang diperlukan untuk mencapai margin galat yang bersedia Anda terima? Beri ia tingkat kepercayaan, margin galat yang Anda tuju, dan gambaran kasar tentang proporsi yang Anda perkirakan akan muncul, lalu ia mengembalikan ukuran sampel terkecil yang memenuhi sasaran itu. Rumusnya adalah margin galat yang dibalik — hubungan yang sama yang diterapkan halaman selang kepercayaan dari arah sebaliknya, tetapi diselesaikan untuk ukuran sampelnya alih-alih untuk lebarnya. Ketika surveinya mencakup populasi yang kecil, koreksi populasi terbatas mengecilkan jawabannya, dan untuk sekumpulan karyawan atau satu sekolah ia mengecilkannya cukup banyak. Isi 0 pada kolom ukuran populasi kalau jumlah populasinya tidak diketahui; angka itu adalah cara menyatakan bahwa koreksinya tidak dipakai.
Rumus
n₀ = z² · p (1 − p) / e² populasi kecil: n = n₀ / ( 1 + (n₀ − 1) / N )
- z
- Nilai kritis untuk tingkat kepercayaannya — 1,9600 pada 95%, 1,6449 pada 90%, dan 2,5758 pada 99%. Ia dicetak pada barisnya sendiri karena ia satu-satunya angka di dalam rumus yang berasal dari tingkat kepercayaannya dan bukan dari anggapan Anda tentang populasinya
- p
- Proporsi yang Anda perkirakan akan ditemukan, sebagai desimal. Ini satu-satunya masukan yang berupa tebakan, dan ia masuk sebagai p(1 − p), yang paling besar pada p = 0,5 — jadi memasukkan 50% adalah anggapan yang menghasilkan sampel terbesar dan yang paling aman
- e
- Margin galatnya, sebagai desimal — setengah lebar yang bersedia Anda terima, dalam satuan yang sama dengan proporsinya. Ia dikuadratkan di penyebutnya, dan itulah sebabnya memangkasnya menjadi separuh membuat sampelnya menjadi kira-kira empat kali lipat
- n₀
- Ukuran sampel untuk populasi yang cukup besar sehingga ukuran populasinya tidak lagi berpengaruh. Ia adalah jawabannya setiap kali populasinya tidak diketahui, dan ia menjadi masukan bagi koreksinya alih-alih menjadi jawaban akhir ketika populasinya diketahui
- N
- Ukuran populasinya, diisi 0 ketika tidak diketahui atau praktis tak terbatas. Koreksinya membagi n₀ dengan angka yang lebih besar daripada pecahan n₀/N, jadi sampel yang sudah dikoreksi selalu keluar di bawah N — meminta lebih banyak orang daripada yang ada bukan risiko yang bisa dihasilkan rumus ini
Pakai kalkulator ini sebelum mengumpulkan data, setiap kali biaya sampelnya nyata — survei dengan insentif per jawaban, pengukuran laboratorium dengan harga per sampel, atau studi klinis dengan sasaran perekrutan. Urutan keputusannya begini: tetapkan margin galat yang bisa Anda terima, tetapkan tingkat kepercayaannya, tebak proporsinya, lalu baca ukuran sampelnya. Hanya yang pertama di antaranya adalah penilaian tentang penelitiannya; dua sisanya adalah kesepakatan atau tebakan. Kalau jawabannya tidak terjangkau, tindakan yang jujur adalah melebarkan margin galatnya dan menyatakannya di laporan, karena margin galat yang tidak bisa Anda danai bukanlah sasaran. Isilah ukuran populasinya setiap kali populasinya memang kecil — di bawah beberapa ribu — karena koreksinya cukup besar di situ dan mengabaikannya berarti merekrut jauh lebih banyak orang daripada yang diperlukan penelitiannya.
Contoh hitungan
Survei nasional pada tingkat kepercayaan 95% dan ±5 poin
- Nilai kritis pada tingkat kepercayaan 95%: 1,96
- Dengan p = 0,5, hasil kali p(1 − p) adalah 0,25, nilai terbesarnya yang mungkin
- n₀ = 1,96² × 0,25 / 0,05² = 3,8416 × 0,25 / 0,0025 = 384,1459
- Dibulatkan ke atas menjadi orang yang utuh: 385 responden
Angka 385 inilah yang ada di balik klaim yang akrab bahwa jajak pendapat atas sekitar seribu orang akurat sampai tiga poin — rapatkan marginnya ke ±3 dan jawabannya menjadi 1.068, dan dari situlah angka itu datang. Ukuran populasinya dibiarkan 0 karena survei nasional adalah pecahan yang dapat diabaikan dari negaranya, dan pada rasio itu koreksinya akan mengubah jawabannya kurang dari satu orang.
Survei yang sama dengan margin ±3 poin yang lebih rapat
- Nilai kritisnya tidak berubah, 1,96, karena tingkat kepercayaannya tidak berubah
- n₀ = 1,96² × 0,25 / 0,03² = 0,9604 / 0,0009 = 1.067,0719
- Dibulatkan ke atas: 1.068 responden
- Bandingkan dengan 385: marginnya mengecil dengan faktor 1,667 dan sampelnya tumbuh dengan faktor 2,78, yaitu 1,667²
Presisi dibeli secara kuadratik. Berpindah dari ±5 ke ±3 poin bukan kenaikan pekerjaan sebesar 67% melainkan 178%, karena margin galatnya dikuadratkan di penyebut. Akibat praktisnya adalah ada lantai bagi seberapa presisi sebuah survei bisa dibuat dengan murah, dan bahwa mengiklankan margin yang lebih rapat dari sekitar ±3 poin berarti sampel dalam hitungan ribuan — tepat pada rentang tempat bias ketidakresponsan mulai lebih berpengaruh daripada galat pengambilan sampel yang sedang dikendalikan rumusnya.
Survei pegawai pada perusahaan berisi 1.000 karyawan
- Angka tanpa koreksinya masih 384,1459, karena ia belum tahu apa-apa tentang populasinya
- Koreksi: 384,1459 / ( 1 + 383,1459 / 1.000 ) = 384,1459 / 1,3831459 = 277,73
- Dibulatkan ke atas: 278 karyawan
- Itu 28% dari seluruh pegawainya, bukan 38% yang akan disiratkan angka tanpa koreksi
Koreksi inilah yang membuat survei atas populasi kecil terjangkau: 278 alih-alih 385, penghematan lebih dari seratus wawancara untuk margin yang dinyatakan sama. Pengaruhnya bertambah seiring sampelnya menjadi bagian yang lebih besar dari populasinya. Pada 100 karyawan jawabannya 80 — Anda tidak bisa menyampel lebih banyak daripada yang ada — dan pada sejuta karyawan koreksinya hanya bernilai satu orang, dan itulah sebabnya 0 untuk populasi yang tidak diketahui adalah nilai bawaan yang wajar dan bukan jalan pintas.
Batasan
Rumus ini menentukan ukuran sampel berupa jawaban, bukan daftar undangan. Kalau sepertiga dari yang diminta tidak menjawab, 385 jawaban berarti mengirim undangan ke sekitar 580 orang, dan kalau orang yang menjawab berbeda secara sistematis dari yang tidak menjawab, tidak ada ukuran sampel yang bisa memperbaiki bias yang dihasilkan — ia hanya membuat galat pengambilan sampelnya lebih kecil daripada galat totalnya. Modelnya juga mengandaikan setiap jawaban adalah pengambilan yang bebas dari populasinya, dan andaian itu runtuh pada rancangan berkelompok: survei atas 400 siswa yang ditarik dari 8 kelas memiliki ukuran sampel efektif yang jauh lebih dekat ke 8, dan hitungan dari halaman ini harus dikalikan dengan pengaruh rancangannya sebelum dipakai. Estimasinya berlaku untuk satu proporsi; rata-rata memerlukan simpangan baku sebagai gantinya, dan itu tidak diterima halaman ini, sedangkan survei yang akan dipecah menjadi subkelompok memerlukan sampel yang diukur untuk subkelompok terkecilnya dan bukan untuk keseluruhannya. Terakhir, ketiga tingkat kepercayaan yang tersedia semuanya adalah kesepakatan, dan tidak satu pun memperhitungkan banyaknya perbandingan yang biasanya dilakukan sebuah analisis sungguhan.
Pertanyaan yang sering diajukan
- Berapa banyak jawaban survei yang saya butuhkan?
- Untuk ±5 poin persentase pada tingkat kepercayaan 95% yang lazim, 385 — dan 1.068 kalau Anda ingin ±3 poin. Kedua angka itu mencakup sebagian besar survei yang diterbitkan, dan keduanya mengandaikan populasi yang cukup besar sehingga ukurannya tidak berpengaruh. Kalau populasinya cukup kecil sehingga Anda masuk akal menyurvei bagian besarnya, isi ukurannya dan koreksinya akan menurunkan angka itu: 1.000 karyawan memerlukan 278 jawaban dan bukan 385, sedangkan 200 karyawan memerlukan 132. Berpijaklah pada margin galatnya lebih dulu, karena itulah angka yang benar-benar akan dibaca oleh pembaca Anda.
- Mengapa proporsi yang diharapkan berbawaan 50%?
- Karena p(1 − p) paling besar pada p = 0,5, dan ukuran sampelnya sebanding dengannya, sehingga memasukkan 50% memberi jawaban terbesar yang mungkin dituntut proporsi mana pun. Itu menjadikannya anggapan yang aman ketika Anda memang tidak tahu: survei yang akhirnya keluar pada 60% akan memiliki margin galat yang sedikit lebih baik daripada yang Anda rencanakan. Bersikap lebih spesifik ada hasilnya — pada p = 90% sukunya turun menjadi 0,09 dari 0,25, sehingga margin galat yang sama hanya memerlukan 36% dari sampelnya. Pakailah nilai selain 50% hanya kalau Anda punya dasar yang bisa dipertahankan, misalnya gelombang sebelumnya dari survei yang sama.
- Apa yang dilakukan koreksi populasi terbatas?
- Ia mengecilkan sampelnya ketika populasinya cukup kecil sehingga mengambil darinya tanpa pengembalian terbukti mengurangi ketidakpastiannya secara terukur. Besar pengaruhnya bergantung pada berapa bagian dari populasi yang Anda sampel: pada 10% koreksinya bernilai beberapa persen dari sampelnya, pada 28% ia bernilai sekitar seperempatnya, dan pada 50% ia bernilai hampir sepertiganya. Isi 0 untuk ukuran populasinya ketika tidak diketahui atau sangat besar, dan isi angka sebenarnya ketika populasinya di bawah beberapa ribu — inilah kolom yang paling sering mengubah jawaban yang sudah dihitung orang.
- Margin galat dan tingkat kepercayaan mana yang sebaiknya saya tuju?
- ±5 poin pada 95% adalah nilai bawaan pada sebagian besar pekerjaan yang diterbitkan, ±3 poin ketika keputusannya bergantung pada hasil yang tipis, dan ±10 poin untuk pekerjaan penjajakan yang hanya peduli pada perbedaan besar. Soal tingkat kepercayaan, 95% adalah kesepakatan yang lazim dan 99% berbiaya sekitar 73% sampel lebih banyak demi selang yang hanya sepertiga lebih lebar. Sebelum merapatkan salah satunya, periksa berapa harga jawabannya: ±3 poin pada tingkat kepercayaan 99% memerlukan 1.843 jawaban, kira-kira lima kali nilai bawaannya. Kalau itu tidak terjangkau, laporkan margin yang lebih lebar alih-alih merekrut sampel yang tidak bisa Anda selesaikan.
- Mengapa jawabannya dibulatkan ke atas menjadi orang yang utuh?
- Karena angka pecahannya adalah aritmetika yang eksak sementara bilangan bulat adalah yang bisa direkrut, dan kedua kebiasaan untuk mengubah yang satu menjadi yang lain menunjuk ke arah yang berbeda. Membulatkan ke yang terdekat bisa membulatkan 384,1459 ke bawah menjadi 384, dan itu meleset dari margin galat yang Anda tuju, padahal sasaran itulah yang Anda minta. Membulatkan ke atas menjamin marginnya terpenuhi atau bahkan terlewati, menelan paling banyak satu wawancara tambahan, dan cocok dengan cara ukuran sampel ditetapkan dalam protokol, tempat 385 adalah komitmen sementara 384,1459 adalah nilai antara.
- Mengapa tidak ada tabel ukuran sampel di halaman ini?
- Karena tabel yang dicari orang di sini adalah kisi tingkat kepercayaan versus margin galat, dan kisi itulah yang sudah dihitung panelnya. Tabel yang dicetak pada tingkat tetap 95% akan bertentangan dengan panelnya begitu Anda beralih ke 99%, dan halaman yang bertentangan dengan dirinya sendiri lebih buruk daripada halaman tanpa tabel — pembacanya harus memutuskan angka mana dari keduanya yang dipercaya. Alasan keduanya adalah tabel itu juga harus memilih satu proporsi, padahal 50% hanya pilihan yang tepat selama ia masih menjadi nilai bawaan yang aman. Ubah tingkat kepercayaannya, margin galatnya, proporsinya, atau ukuran populasinya, dan jawabannya dihitung ulang — itulah seluruh isi dari tabel yang sedang orang cari.
Referensi
- 3.1 Terminology — Introductory Statistics 2e (relative frequency approaching probability as a sample grows, which is the property that makes a target margin of error meaningful in advance) — OpenStax (Rice University)
- 1.3.6.1. What is a Probability Distribution — e-Handbook of Statistical Methods (the distribution of an estimate, which is what the margin of error is a quantile of) — National Institute of Standards and Technology (NIST)
- 1.3.6.7.1. Cumulative Distribution Function of the Standard Normal Distribution — e-Handbook of Statistical Methods (the cumulative function the critical values come from; the same values, used in reverse here to size a sample rather than to bound an estimate) — National Institute of Standards and Technology (NIST)