Langkah awal analisis data adalah mengklasifikasikan data. Klasifikasi data berarti memilah-
milah data dari yang bersifat heterogen ke dalam kelompok-kelompok yang homogen,
sehingga sifat-sifat data yang menonjol mudah dilihat
a. Dasar-dasar klasifikasi
Klasifikasi berdasarkan sifat-sifat atau ciri tertentu dari data, biasanya diterapkan pada data
kualitatif. Misalnya: warna kulit, ada putih, kuning, dan coklat. Klasifikasi secara kualitatif ini
sulit untuk diukur secara kuantitatif. Apabila kita menghadapi kejadian seperti itu maka cara
yang dapat kita lakukan adalah kita menentukan satu kelompok data dengan sifat tertentu, misal
: kulit putih maka kelompok yang lain adalah kelompok bukan kulit putih, atau muslim dan
nonmusim. Klasifikasi menjadi 2 subkelompok ini disebut pembagian dikotomi (dichotomy),
sedang klasifikasinya disebut klasifikasi sederhana (simple classification). Dan apabila
subkelompok tersebut dirinci lebih lanjut maka klasifikasi ini disebut manifold classification.
Seriation adalah penyusunan data dalam urutan yang sistematis Penyusunan data secara
sistematis dapat dilakukan dengan berbagai cara, yaitu:
1. Berdasarkan Waktu
Waktu di sini merupakan dasar utama untuk menyusun data maka selanjutnya disebut dengan
data time series. Contoh:
Tabel 1.1.
2000 10
2001 11
2002 13
2003 15
2004 16
2005 17
2006 19
2007 22
2008 25
2. Berdasarkan Daerah/Wilayah
Daerah/wilayah merupakan faktor penting untuk menyusun data. Sebagai contoh disajikan
dalam Tabel 1.2
Tabel 1.2.
1. Makmur 26
2. Subur 30
3. Ayem 25
4. Tentrem 20
3. Berdasarkan Keadaan/Frekuensi
Penyusunan data berdasarkan kondisi fisik seperti: tinggi, berat, ataupun metode gradasi yang
lain, berdasarkan banyaknya kejadian di suatu tempat tertentu dan waktu tertentu.
a. Secara individual
b. Secara kelompok
Metode ini merupakan cara menyusun data sesuai dengan hasil observasi.
Sebagai contoh: seorang dosen mengadakan penelitian mengenai jumlah anak dalam keluarga
mahasiswa yang mengikuti kuliahnya. Hasil penelitiannya adalah sebagai berikut:
2 3 3 1 4
3 4 2 2 1
1 2 1 5 3
4 6 4 3 2
2 1 5 2 5
Dari data tersebut dapat diketahui komposisi jumlah anak dalam keluarga mahasiswa, tetap
masih agak susah diamati karena belum tersusun secara rapi. Cara penyusunan seperti itu hanya
dapat diterapkan pada data yang jumlahnya terbatas. Data seperti itu disebut dengan data
mentah (raw data). Untuk memperjelas, data tersebut dapat disusun menjadi lebih teratur
seperti tampak dalam Tabel 1.4 berikut:
Tabel 1.4.
1 2 3 3 4
1 2 3 3 5
1 2 3 4 5
1 2 3 4 5
1 2 3 4 5
Data individual (ungrouped data) tersebut disusun secara teratur, sehingga dengan mudah
dapat diketahui berapa orang mahasiswa yang merupakan anak tunggal, berapa yang dua
bersaudara dan seterusnya.
Metode ini merupakan cara menyusun data dalam kelompok-kelompok berdasarkan interval
tertentu. Selanjutnya dari masing-masing kelompok akan tampak berapa kali terjadinya (berapa
frekuensinya).
1) Rangkaian yang diskrit (discrete series atau discontinuous series) 2) Rangkaian yang
kontinu (continuous series)
Perbedaan cara penyusunan data ini didasarkan pada sifat dari data tersebut, apakah
variabelnya bersifat diskrit atau kontinu.
Data atau variabel diskrit adalah data yang hanya dapat dinyatakan dalam bilangan bulat.
Contoh : jumlah anak, jumlah penduduk, jumlah mobil dan sebagainya. Contoh distribusi data
yang bersifat diskrit dapat dilihat dalam Tabel 1.5.
Tabel 1.5.
1–2 12
3–4 9
5–6 4
Sedangkan data atau variabel kontinu adalah data yang dapat dinyatakan dengan bilangan
pecahan. Misalnya: tinggi badan, berat badan, nilai, produksi beras, keuntungan perusahaan
dan sebagainya. Contoh distribusi data yang bersifat kontinu dapat dilihat dalam Tabel 1.6.
Tabel 1.6 disebut juga dengan distribusi frekuensi atau tabel frekuensi.
10 – 19,9 3
20 – 29,9 5
30 – 39,9 9
40 – 49,9 6
50 – 59,9 4
Di dalam statistik deskriptif kita mengusahakan agar data dapat disajikan dalam bentuk yang
lebih berguna, lebih mudah dipahami, dan lebih cepat dimengerti. Kalau datanya hanya sedikit,
tanpa dibuat tabel pun data tetap mudah dibaca tetapi kalau datanya banyak sekali maka
membacanya agak sulit, dan memerlukan waktu yang cukup lama untuk mencermatinya. Untuk
memudahkan dan mempercepat kita memahami data tersebut maka data yang sudah
dikumpulkan, disusun agar lebih teratur, dalam bentuk tabel yang disebut dengan distribusi
frekuensi. Hal yang dimaksud distribusi frekuensi adalah suatu daftar yang membagi data yang
ada ke dalam beberapa kelas.
Tabel 1.7.
Umur Frekuensi
20 – 29,9 5
30 – 39,9 10
40 – 49,9 15
50 – 59,9 13
60 – 69,9 7
Jumlah 50
Tabel 1.8.
Tinggi badan
150 – 159,9 2 4 2
160 – 169,9 1 6 7 4
170 – 179,9 6 6 5
Jumlah 3 20 17 10
Tabel 1.9.
Petani 500
Pedagang 400
Pengusaha 50
Lain-lain 50
Jumlah 1.300
Tabel 1.10.
Jenis kelamin
perempuan
Mata pencaharian Laki-laki
Pengusaha 30 20
Lain-lain 25 25
Pembahasan dalam membuat suatu distribusi frekuensi dibagi menjadi dua bagian. Bagian
pertama akan dibahas mengenai penyusunan distribusi frekuensi menurut bilangan. Dalam
bagian ini akan dibahas tahap-tahap pembuatan distribusi frekuensi, mulai dari penentuan
banyaknya kelas, perhitungan range maupun perhitungan calss interval, dilanjutkan dengan
penentuan kelas dan diakhiri dengan tabulasi.
Bagian kedua adalah pembuatan distribusi frekuensi menurut kategori. Cara membuat
distribusi frekuensi menurut kategori lebih cepat daripada pembuatan distribusi frekuensi
menurut bilangan. Langkah yang harus dilakukan hanya terdiri dari dua tahap, yaitu
menentukan kelas dan yang ke dua mengadakan tabulasi.
Penyusunan distribusi frekuensi menurut bilangan dapat dilakukan melalui beberapa tahap:
Kita tentukan jumlah kelas untuk mengelompokkan data yang ada. Dalam menentukan jumlah
kelas ini bebas, bisa dibagi menjadi 5 kelas atau 10 kelas atau berapa saja sesuai dengan
kebutuhan dan banyak sedikitnya data. Salah satu cara untuk menentukan jumlah kelas adalah
dengan menggunakan rumus Sturges. Menurut Sturges banyaknya klas dipengaruhi oleh
banyaknya data. Hubungan antara jumlah kelas dan banyaknya data dapat dinyatakan dalam
bentuk rumus sebagai berikut:
K = banyaknya kelas
N = jumlah data
K= 1+ 3,3(2) =7,6
Banyaknya kelas harus merupakan bilangan bulat. Oleh karena itu, kita lakukan pembulatan.
Caranya seperti yang biasa kita lakukan dalam mengadakan pembulatan, yaitu apabila bilangan
pecahan lebih dari 0,5 maka kita bulatkan ke atas, dan apabila kurang dari 0,5 kita bulatkan ke
bawah. Maka dalam hal ini kita akan membuat 8 kelas.
Range adalah perbedaan antara data terkecil dengan data terbesar, atau sama dengan selisih
antara data terbesar dan data terkecil.
Penentuan range sangat mudah, yaitu kita cari data terbesar dan data terkecil, kemudian kita
cari selisihnya. Misalnya data terbesar adalah 90 dan data terkecil 40 maka rangenya sebesar
50, yaitu 90 dikurangi 40.
Lebar kelas dapat dihitung dengan membagi range dengan banyaknya kelas yang sudah
dibulatkan. Lebar kelas (interval class) dapat dihitung
𝑅
dengan rumus : 𝐶𝑖 = 𝐾
Dari contoh di atas kita sudah menentukan banyaknya kelas (K) = 7 dan range sebesar 40 maka
kita dapat menghitung kelas interval yaitu SO : 8 = 6,25.
Pada dasarnya kelas interval tidak harus merupakan bilangan bulat. Akan tetapi, seandainya
merupakan bilangan bulat akan lebih bagus. Untuk itu diperlukan pembulatan. Dalam
membulatkan , dianjurkan pembulatannya ke atas, karena kalau dibulatkan ke bawah,
dikhawatirkan kelasnya menjadi terlalu kecil sehingga tidak dapat menampung semua data
yang ada. Maka kelas intervalnya dapat dibulatkan menjadi 7.
4. Menentukan Kelas
4 Semua data dapat masuk, artinya data terkecil dapat masuk ke dalam kelas terkecil
dan data terbesar dapat masuk ke dalam kelas terbesar.
4 Batas atas suatu kelas dibuat sedikit lebih kecil dari batas bawah kelas di atasnya.
Kelas ke 1 40 – 46,9
Kelas ke 2 47 – 53,9
Kelas ke 3 54 – 60,9
Kelas ke 4 61 – 67,9
Kelas ke 5 68 – 7 4,9
Kelas ke 6 75 – 81,9
Kelas ke 7 82 – 88,9
Kelas ke 8 90 – 96,9
Setelah selesai menentukan kelas, kita periksa sekali lagi apakah data terkecil dapat masuk
kelas ke 1 dan apakah data terbesar dapat masuk kelas ke 8. Dan seterusnya kita periksa apakah
besarnya batas atas kelas ke 1 sedikit di bawah batas bawah kelas ke 2, dan seterusnya. Kalau
semuanya sudah beres, selesailah sudah pembuatan kelas, dan kita dapat meneruskan langkah
terakhir yaitu menentukan frekuensi dari masing-masing kelas.
5. Menentukan Frekuensi
Untuk mencari frekuensi masing-masing kelas dilakukan dengan cara mengadakan tabulasi
yaitu memasukkan data ke dalam tabel.
Contoh:
Berikut ini adalah data tentang besarnya keuntungan bersih per tahun dari 50 perusahaan batik
di Yogyakarta masing-masing sebagai berikut : (Juta rupiah)
71 81 35 50 38 64 74 41 68 54
41 41 61 91 55 73 54 53 45 77
44 78 55 48 69 85 67 39 76 60
94 66 98 66 79 42 65 94 89 88
Jawab
Untuk membuat distribusi frekuensi tentang keuntungan 50 perusahaan di atas dapat dilakukan
dengan beberapa langkah.
Banyaknya kelas merupakan bilangan diskrit, jadi harus bulat, tidak boleh pecahan maka kalau
K diperoleh bilangan pecahan maka harus kita bulatkan. Sehingga jumlah kelasnya kita
bulatkan menjadi 7.
Dua data di atas kita dapat dihitung rangenya, yaitu dengan mencari selisih antara data terbesar
dan data terkecil = 98 – 33 = 65
Dua data di atas dapat dihitung kelas intervalnya, yaitu range dibagi banyaknya kelas Ci =
65/7 = 9,28. Pada dasarnya kelas interval tidak harus bulat, tetapi seandainya bulat, akan lebih
bagus. Dalam melakukan pembulatan disarankan untuk membulatkan ke atas. Misalnya: Ci =
9,28 dibulatkan menjadi 10
d. Menentukan kelas
Dalam menentukan kelas, kita memakai hasil perhitungan yang sudah dilakukan, yaitu banyak
kelas 7 dan kelas interval 10. Kita melakukan pembulatan kelas interval dari 9,28 menjadi 10.
Maka kita membuat kelas pertama dengan batas bawahnya 30 dan batas atas 39,9. Sedangkan
kelas kedua dengan batas bawah 40 dan batas atas 49,9, dan seterusnya kita buat 7 kelas.
Frekuensi tiap-tiap kelas dapat dihitung dengan memakai tanda garis (stik) setiap ada data yang
masuk di dalamnya. Misalnya, dalam contoh data pertama sebesar 60 maka pada kelas ke 4
diberi tanda garis (/). Data kedua 33 maka pada kelas ke 1 diberi tanda garis (/) dan seterusnya,
sampai semua data sudah dimasukkan ke dalam tabel. Selanjutnya, kita hitung banyak garis
dalam masing-masing kelas, itulah frekuensi dari kelas tersebut. Untuk lebih jelasnya dapat
dilihat dalam Tabel 1.5.
Tabel 1.11.
Keuntungan Frekuensi
30 – 39,9 //// =4
40 – 49,9 ///// // =7
80 – 89,9 ///// / =6
90 – 99,9 //// =4
Jumlah 50
Dari proses di atas kita mengetahui frekuensi dari masing-masing kelas, setelah selesai tabulasi,
kita bisa membuat distribusi frekuensi yang baik yaitu distribusi frekuensi yang memenuhi
beberapa kriteria (syarat).
1) mempunyai nomor tabel. Tujuannya agar kita bisa membedakan tabel yang satu dengan
tabel yang lain.
Kelas yang overlap yaitu kelas yang batas atasnya sama dengan batas bawah kelas di atasnya.
Seperti terlihat pada tabel berikut.
Tabel 1.12.
Keuntungan Frekuensi
30 – 40 4
40 – 50 7
50 – 60 8
60 – 70 12
70 – 80 9
80 – 90 6
90 – 100 4
Jumlah 50
Suatu distribusi frekuensi dikatakan mempunyai kelas yang tidak sama, apabila distribusi
frekuensi tersebut memiliki kelas yang kelas intervalnya tidak sama dengan kelas yang lain.
Hal seperti itu harus dihindari karena akan mengaburkan perpencaran dari data. Contoh
distribusi yang memiliki kelas yang tidak sama dapat dilihat dalam tabel berikut:
Tabel 1.13.
Keuntungan Frekuensi
30 – 39,9 4
40 – 59,9 15
Jumlah 50
Kelas terbuka adalah kelas yang tidak mempunyai salah satu batas, seperti yang dapat kita
lihat dalam tabel berikut:
Tabel 1.14.
30 – 39,9 4
40 – 49,9 7
50 – 59,9 8
60 – 69,9 12
70 ke atas 19
jumlah 50
Sebagai contoh
Dari proses yang sudah kita lakukan maka kita dapat bentuk suatu distribusi frekuensi yang
baik, yang sesuai dengan kriteria tersebut di atas, sebagai berikut
Tabel 1.15.
30 – 39,9 4
40 – 49,9 7
50 – 59,9 8
60 – 69,9 12
70 – 79,9 9
80 – 89,9 6
90 – 99,9 4
Jumlah 50
1) Batas kelas ada dua macam yaitu batas bawah dan batas atas
3) Class Boundary/tepi kelas adalah pertengahan antara batas atas suatu kelas dengan
batas bawah kelas di atasnya
5) Class interval/klas interval/lebar kelas adalah perbedaan antara class boundary suatu
kelas dengan class boundary kelas sebelumnya
6) Kelas terbuka adalah kelas yang tidak memiliki salah satu batasnya
Suatu distribusi menurut bilangan dapat digambar menjadi suatu histogram atau poligon.
a. Histogram
Histogram sering disebut sebagai diagram kolom. Cara membuatnya dengan membuat masing-
masing kelas menjadi sebuah kolom, seperti terlihat pada gambar berikut.
Histogram
b. Poligon
Cara menggambarkan poligon adalah dengan cara menghubungkan titiktitik yang absisnya
adalah titik tengah (mid point) dan ordinatnya adalah frekuensi, seperti terlihat dalam gambar
berikut.
Gambar 1.2. Poligon
Cara membuat distribusi frekuensi menurut kategori tidak diperlukan prosedur yang berbelit-
belit. Langkah pertama kita menentukan kelas, kelas yang kita tentukan sesuai dengan kategori
dari data tersebut. Selanjutnya, kita mengadakan tabulasi data.
Sebagai contoh kita mempunyai data tentang mata pencaharian penduduk. Dari data tersebut
dapat diketahui bahwa penduduk di daerah tersebut memiliki 5 jenis mata pencaharian, yaitu
Tabel 1.16.
Petani 3.600
Pedagang 2.500
Pengusaha 700
Jumlah 8.000