Prediksi Penjualan Buku dengan C4.5
Prediksi Penjualan Buku dengan C4.5
1
Prediksi jumlah penjualan adalah faktor penting yang Basis data (database) adalah sistem terkomputerisasi
menentukan kelancaran usaha suatu perusahaan. yang tujuan utamanya adalah memelihara data yang
Begitu juga Prediksi ini sangat berguna untuk sudah diolah atau informasi dan membuat informasi
menentukan berapa banyak barang yang akan dipesan yang tersedia saat dibutuhkan. Pada intinya basis data
pada bulan selanjutnya. Permasalahan umum yang adalah media untuk menyimpan data agar bisa diakses
biasa dihadapi oleh suatu perusahaan adalah dengan mudah dan cepat) [3].
bagaimana memprediksi atau meramalkan penjualan
2.3. Data Mining
barang di masa mendatang berdasarkan data penjualan
sebelumnya. Prediksi tersebut sangat berpengaruh Data Mining sebagai proses untuk menemukan kolerasi
untuk menentukan target penjualan yang harus dicapai. atau pola dari ratusan atau ribuan field dari sebuah
Perencanaan yang efektif baik untuk jangka panjang relasional basis data yang besar. Data Mining adalah
maupun jangka pendek bergantung pada peramalan serangkaian proses untuk menggali nilai tambah
permintaan untuk produk yang akan dijual. Untuk berupa informasi yang selama ini tidak diketahui secara
menghasilkan prediksi yang tepat tentu saja dibutuhkan manual dari suatu basis data.
kecermatan dan ketelitian.
Data Mining bertujuan untuk memperbaiki teknik
Pustaka Thariqul Izzah merupakan suatu tempat tradisional sehingga bisa menangani :
penerbit macam – macam buku literasi Islam, berbagai
1) Jumlah data yang sangat besar
macam kategori atau judul buku yang dijualnya, dari
buku pemikiran islam, ekonomi islam, sampai politik 2) Dimensi data yang tinggi
islam. Pustaka Thariqul Izzah pun menjual buku
terbitannya di marketplace dan sosial media seperti 3) Data yang heterogen dan berbeda sifat
Shopee, Facebook, WhatsApp dan Instagram. Dengan Adapun Pengelompokan Data Mining dibagi menjadi
harga jualnya yang lumayan murah daripada diagen beberapa kelompok, yaitu :
lainnya, Pustaka Thariqul Izzah pun memperoleh
penjualan yang sangat banyak sehingga kehabisan stok a. Deskripsi
barang. Pemilik Pustaka Thariqul Izzah ini pun ingin Deskripsi merupakan cara untuk menggambarkan pola
mengetahui seberapa banyak penjualan di bulan dan kecenderungan yang terdapat dalam data yang
berikutnya sehingga penjual dapat menyiapkan barang dimiliki.
yang cukup untuk di jual dibulan berikutnya.
b. Estimasi
Salah satu wujud nyata dari upaya ini yaitu menghitung
potensi penjualan seakurat mungkin sehingga akan Estimasi hampir sama dengan klasifikasi, kecuali
diketahui seberapa besar penjualan buku pada Pustaka variable target estimasi lebih ke arah numerik daripada
Thariqul Izzah. Algoritma yang akan digunakan untuk ke arah kategori. Model yang dibangun menggunakan
memprediksi penjualan dalam kasus ini adalah record lengkap yang menyediakan nilai variable target
algoritma C4.5, Metode ini akan berusaha sebagai nilai prediksi.
mendapatkan prediksi penjualan dan dapat diketahui c. Prediksi
gambaran fluktuasi penjualan pada perusahaan tersebut.
Prediksi menerka sebuah nilai yang belum diketahui
2. Landasan Teori dan juga memperkirakan nilai untuk masa mendatang.
2.1. Data d. Klasifikasi
Data merupakan komponen dasar dari informasi yang Dalam klasifikasi terdapat target variable kategori,
akan diproses lebih lanjut untuk menghasilkan misal penggolongan pendapatan dapat dipisahkan
informasi. Sedangkan menurut Longkutoy dalam dalam tiga kategori, yaitu tinggi, sedang, dan rendah.
bukunya “Pengenalan Komputer”, Data adalah suatu
e. Pengklasteran
istilah majemuk yang berarti fakta atau bagian dari
fakta yang mengandung arti yang digabungkan dengan Merupakan pengelompokan record, pengamatan, atau
kenyataan, simbolsimbol, gambar-gambar, angka- memperhatikan dan membentuk kelas objek-objek
angka, huruf-huruf, atau simbol-simbol yang yang memiliki kemiripan.
menunjukkan suatu ide, objek, kondisi atau suatu dan
lain-lain [1]. d. Asosiasi
2
2.1. : 1. Mengetahui kondisi masa mendatang.
2. Perencanaan produksi, pemasaran, keuangan, dan
lain-lain.
3. Keperluan investasi pada sebuah perusahaan.[4]
2.7. Penjualan
Adapun beberapa pengertian penjualan menurut
beberapa ahli, yaitu sebagai berikut:
1. Penjualan merupakan kegiatan yang dilakukan oleh
penjual dalam menjual barang atau jasa dengan
harapan akan memperoleh laba dari adanya transaksi-
Gambar 2.1. Tahapan SSProses Data Mining
transaksi tersebut [5]
1. Data Cleaning, tahap pembersihan data yang tidak
2. Menurut Swastha penjualan adalah suatu proses
konsisten.
pertukaran barang atau jasa antara penjual dan pembeli.
2. Data Integration, langkah menggabungkan data dari Jadi dapat disimpulkan bahwa penjualan adalah usaha
beberapa sumber. yang dilakukan manusia untuk menyampaikan barang
kebutuhan yang telah dihasilkan kepada mereka yang
3. Data Selection, data yang tidak dikembalikan lagi ke
membutuhkan dan telah ditentukan atas tujuan bersama
database setelah proses data cleaning.
[6].
4. Data Transformation, data berubah atau bersatu
2.8. Buku
menjadi bentuk yang tepat untuk menambang dengan
ringkasan performa atau operasi regrasi. Buku berasal dari kata Biblio (Yunani), Bibliotec
(Jerman), Bibliotheque (Prancis), dan Bibliotecha
5. Data Mining, merupakan proses yang digunakan
(Spanyol/Portugis) yang berarti pustaka, buku.
untuk mengolah suatu data dengan menggunakan
Ensiklopedia Indonesia menjelaskan buku dalam arti
metode.
luas.
6. Evaluation and presentation, pengidentifikasian pola
Menurut Soeatminah dalam buku Wiji Suwarno
berdasarkan tindakan yang digunakan.
menyatakan bahwa “buku adalah wadah informasi
7. Knowledge, hasil yang dicapai berupa pengetahuan berupa lembaran kertas yang dicetak, dilipat, dan diikat
atau sebuah informasi. menjadi satu pada punggungnya serta diberi
sampul”.[7].
2.9. Algoritma C4.5
2.5. Karakteristik Data Mining
Algoritma C4.5 merupakan algoritma yang digunakan
Adapun karakteristik data mining sebagai berikut ;
untuk melakukan proses prediksi data dengan teknik
1. Data mining berhubungan dengan penemuan sesuatu pohon keputusan. Algoritma C4.5 merupakan ekstensi
yang tersembunyi dan pola data tertentu yang tidak dari algoritma ID3 dan menggunakan prinsip decision
diketahui sebelumnya. 2. Data mining biasa tree yang mirip.
menggunakan data yang sangat besar. Biasanya data Ide dasar dari algoritma ini adalah pembuatan pohon
yang besar digunakan untuk membuat hasil lebih dapat keputusan berdasarkan pemilihan atribut yang
dipercaya.
memiliki prioritas tertinggi atau dapat disebut memiliki
3. Data mining berguna untuk membuat keputusan nilai gain tertinggi berdsarkan nilai entropy atribut
kritis. tersebut sebagai poros atribut klasifikasi. Kemudian
secara rekursif cabang-cabang pohon diperluas
2.6. Prediksi sehingga seluruh pohon terbentuk. Menurut kamus IGI
Prediksi adalah sama dengan ramalan atau perkiraan. Global (Internasional Publisher of Progressive
Menurut Kamus Besar Bahasa Indonesia, prediksi Academic), entropy adalah jumlah data yang tidak
adalah hasil dari kegiatan memprediksi atau meramal relevan terhadap informasi dari suatu kumpulan data.
atau memperkirakan. Prediksi bisa berdasarkan metode Gain adalah informasi yang didapatkan dari perubahan
ilmiah ataupun subjektif belaka. Berbeda dengan entropy pada suatu kumpulan data, baik melalui
pengertian prediksi secara bahasa yang berarti lamaran observasi atau bisa juga disimpulkan dengan cara
atau perkiraan yang sudah menjadi pengertian yang melakukan partisipasi terhadap suatu set data.
baku. Berdasarkan apa yang ditulis oleh jefri, terhadap empat
Manfaat dalam melakukan prediksi adalah : langkah dalam proses pembuatan pohon keputusan
pada algoritma C4.5, yaitu :
3
1. Memilih atribut sebagai akar gambar, animasi, suara dan video atau gabungan dari
semuanya yang di sediakan melalui jalur koneksi
2. Membuat cabang untuk masing-masing nilai
internet sehingga dapat di akses dan dilihat oleh semua
3. Membagi setiap kasus dalam cabang orang di seluruh dunia [11].
4. Mengulangi proses dalam setiap cabang sehingga 3. Metode
semua kasus dalam cabang memiliki kelas yang sama.
3.1. Metode Penelitian
Data yang dimilki harus disusun menjadi sebuah tabel
berdasarkan kasus dan jumlah responden sebelum Pada tahap metode penelitian ini penulis
dilakukan perhitungan untuk mencari nilai entropy dan menggunakan metode penelitian kuantitatif, yang
gain. dimana metode ini dipakai untuk meneliti pada
populasi atau sampel tertentu, pengumpulan data
Entropy(S) = (Rumus 1) menggunakan instrument penelitian, Analisa yang
Rumus 1 merupakan rumus yang digunakan dalam bersifat kuantitatif atau statistik dengan tujuan
perhitungan entropy yang digunakan untuk untuk menguji dan membuktikan hipotesis yang
menentukan seberapa informatif atribut tersebut. telah dibuatkan oleh penulis.
Berikut keterangannya : S : Himpunan kasus n : Jumlah 3.2. Metode Pemilihan Sampel
partisi s pi : jumlah kasus pada partisi ke – i Gain(S,A)
= Entropy(S) - *Entropy (Si) (Rumus 2) Metode Pemilihan Sampel dari penelitian ini
adalah mengambil beberapa sampel atau
Rumus 2 merupakan rumus yang digunakan dalam mengambil sebagian dari data penjualan buku
perhitungan gain setelah melakukan perhitungan yang ada pada Pustaka Thariqul Izzah, disini saya
entropy. Berikut keterangannya : s : himpunan kasus n : hanya mengambil 2 tahun kebelakang dari bulan
jumlah partisi atribut A │si│ : jumlah kasus pada Januari 2019 sampai bulan Juni tahun 2021 secara
partisi ke –i random yang banyak terjual sejumlah 500 buku
dan di ambil sampel sebanyak 112 buku.
│s│ : jumlah kasus dalam S
3.3. Metode Pengumpulan Data
Dengan mengetahui rumus-rumus diatas, data yang
telah diperoleh dapat dimasukkan dan di proses dengan Dalam pembuatan penelitian ini metode
algoritma C4.5 untuk proses pembuatan decision tree . pengumpulan data yang dilakukan penulis untuk
memperoleh informasi yang dibutuhkan penulis
2.10. MYSQL dalam tujuan penelitian. Dalam penelitian ini,
Menurut Masria (2012:185), MySQL adalah sebuah penulis menggunakan 3 metode pengumpulan data,
perangkat lunak sistem manajemen basis data SQL yaitu :
(Structure Query Languae) atau DBMS (database Observasi, Wawancara dan Studi kepustakaan. a.
management system yang multi thread, multi-user, Observasi
dengan sekitar 6 juta instalasi di seluruh dunia[8].
Observasi pada penelitian ini adalah penulis
2.11. PHP (Hypertext Preprocessor) mengamati secara langsung terhadap objek
Preprocessor Hypertext (PHP) PHP merupakan penelitian dengan datang langsung ke Pustaka
singkatan dari PHP Hypertext Preprocessor, PHP Thariqul Izzah serta meninjau aktivitas yang ada
merupakan bahasa pemrograman skrip yang diletakkan disana, kemudian mencatat data apa saja yang
dalam server yang biasa digunakan untuk membuat diperlukan dalam penelitian.
aplikasi web yang bersifat dinamis. Maksud web Wawancara
dinamis adalah dapat membentuk suatu tampilan web
berdasarkan permintaan terkini, dapat dilakukan secara Wawancara adalah teknik pengumpulan data yang
command line, yaitu skrip PHP dapat dijalankan tanpa yang dilakukan dengan melakukan tanya jawab
melibatkan web server maupun browser[9]. dengan narasumber bagian dari perusahaan yaitu
bertujuan untuk menggali data atau informasi yang
2.12. Xampp berhubungan dengan objek penelitian, maka dari
XAMPP adalah sebuah software web server apache itu dalam teknik ini penulis melakukan wawancara
yang di dalamnya sudah tersedia database server dengan manajer Pustaka Thariqul Izzah.
MySQL dan dapat mendukung pemograman PHP [10]. Studi Kepustakaan
Studi Pustaka adalah teknik pengumpulan data
2.13. Website yang dilakukan dengan menghimpun, mempelajari,
dan menganalisis dokumen-dokumen baik
Website dapat diartikan sebagai kumpulan halaman dokumen tertulis, gambar maupun elektronik
yang berisi informasi data digital baik berupa teks, seperti buku-buku referensi, jurnaljurnal, paper
4
dan media lainnya yang berkaitan dengan objek 2. Setelah data disiapkan, maka dilakukan proses
penelitian. perhitungan jumlah data buku yang laris dan tidak laris
berdasarkan nilai atribut.
4. Hasil dan Pembahasan
4.1. Pengumpulan Data Dan Analisis 3. Setelah melakukan proses penghitungan tersebut,
maka dilakukan penghitungan nilai entropy total
4.1.1 Pengumpulan Data dimana diketahui pada proses penghitungan
sebelumnya jumlah buku yang laris berjumlah 20 dan
Sebelum digunakan dan diproses maka data – data buku yang tidak laris berjumlah 70.
tersebut akan disiapkan (preprocessing) terlebih
dahulu, sehingga nantinya akan memiliki kelas 𝐸𝑛𝑡𝑟𝑜𝑝𝑦 (𝑆) = ∑𝑛𝑖=1 − 𝑝𝑖. 𝑙𝑜𝑔2𝑝𝑖 (IV.1)
binominal atau polynominal sesuai aturan yang telah
dibuat dan berdasarkan nilai datanya. Pada Tabel 4.1 = (-20/90)*𝑙𝑜𝑔2(20/90)+(-70/90)*𝑙𝑜𝑔2(70/90)
ditunjukan pembagian variabel dan kelas data yang
akan digunakan pada proses analisis data mining. = 0.764
Tabel 4.1 Pembagian Variabel Dan Kelas Data 4. Setelah dilakukan penghitungan nilai entropy, maka
dilakukan juga penghitungan nilai gain untuk masing –
masing atribut sehingga diperoleh nilai gain tertinggi
nantinya. Perhitungan nilai gain dilakukan untuk
menentukan atribut dengan nilai gain tertinggi guna
menjadikan atribut tersebut akar. Berikut adalah
contoh salah satu atribut yang dilakukan penghitungan
nilai gain nya. 𝐺𝑎𝑖𝑛 (𝑆, 𝐴) = 𝐸𝑛𝑡𝑟𝑜𝑝𝑦 𝐸𝑛𝑡𝑟𝑜𝑝𝑦 (𝑆𝑖)|𝑆|
(IV.2)
Adapun hasil dari preprocessing sesuai dengan jenis = 0.764 – ((70/90*0) + (20/90*0))
kelas datanya dapat dilihat pada tabel 4.2 dibawah ini :
= 0.0920
Tabel 4.2 Data Preprocessing
Untuk memperoleh nilai gain tertinggi dimana nilai
gain yang diperoleh akan dijadikan sebagai akar maka
harus ditentukan oleh hasil perhitungan nilai entropy
dan gain dari semua atribut.
5
Gambar 4.1 Proses design dan import dengan tools
RapidMiner
Gambar 4.2 Design cross validation
6
[5] Mulyadi. 2016. Sistem Akuntansi. Jakarta:
Salemba Empat.
[6] Swasta, Basu, 2014, ManajemenPemasaran
Modern, BPFE, Yogyakarta.
[7] Suwarno Wiji, 2011. Perpustakaan & Buku:
Wacana Penulisan & Penerbitan.
[8] Masria. 2012. Perakitan Komputer. Jakarta:
Lentera Printing.
[9] Wibowo, A. 2014. “Pembuatan Sistem
Informasi Penjualan Furniture Dan electronic
Pada Toko Joice Group”. Indonesia Journal
on Netwoking and security,3(4),
[10] Februariyanti H, Zuliarso E. 2012. “Rancang
Bangun Sistem Perpustakaan untuk Jurnal
Elektronik”. Semarang: Universitas
Stikubank.
[11] Rohi, Abdullah. 2020. 7 In 1 Pemrograman
Web Untuk Pemula Cara Cepat dan Efektif
Menjadi Web Programmer: Jakarta. PT Elex
Media Komputindo