PENGANTAR
PEMROSESAN DATA
MULTIMEDIA - WEEK 6
DR. AAIN EKA KARYAWATI, [Link]., [Link].
INFORMATICS UNUD
SUPERVISED LEARNING
1. PENGERTIAN
Supervised Learning adalah pendekatan dalam pembelajaran mesin (Machine
Learning) di mana model dilatih menggunakan data berlabel. Model belajar untuk
memetakan hubungan antara input (fitur) dan output (label) dengan tujuan
meminimalkan kesalahan dalam prediksi.
SUPERVISED LEARNING
PERBEDAAN SUPERVISED LEARNING VS UNSUPERVISED LEARNING
SUPERVISED LEARNING
2. JENIS SUPERVISED LEARNING
2.1 Klasifikasi (Classification)
Tujuan: Memprediksi kategori (kelas) dari data input.
Contoh:
• Deteksi email spam / tidak spam.
• Diagnosis penyakit berdasarkan gejala.
Algoritma Populer:
• K-Nearest Neighbors (KNN) → Prediksi berdasarkan tetangga terdekat.
• Decision Tree → Membangun aturan berbasis pohon keputusan.
• Naïve Bayes → Model probabilistik berdasarkanTeorema Bayes.
• Support Vector Machine (SVM) → Mencari hyperplane terbaik untuk memisahkan kelas.
SUPERVISED LEARNING
2. JENIS SUPERVISED LEARNING
2.2 Regresi (Regression)
• Tujuan: Memprediksi nilai numerik berdasarkan input.
• Contoh:
• Prediksi harga rumah berdasarkan ukuran dan lokasi.
• Peramalan jumlah penjualan dalam bisnis.
• Algoritma Populer:
• Linear Regression → Mencari garis lurus terbaik yang mewakili hubungan antara variabel.
• Polynomial Regression → Regresi menggunakan polinomial untuk menangkap hubungan non-linear.
• Random Forest Regression → Kombinasi banyak pohon keputusan untuk prediksi yang lebih akurat.
SUPERVISED LEARNING
3. METODOLOGI PEMBUATAN MODEL SUPERVISED LEARNING
3.1 Pengumpulan Data
• Tujuan: Mengumpulkan dataset yang relevan untuk pelatihan model.
• Sumber Data: Database, API, Web Scraping, Dataset publik seperti Kaggle, UCI.
• Format Data: CSV, JSON, SQL, Excel, dll.
Contoh Dataset:
• Klasifikasi: Dataset Iris (prediksi jenis bunga berdasarkan fitur).
• Regresi: Dataset House Prices (prediksi harga rumah berdasarkan fitur).
SUPERVISED LEARNING
3. METODOLOGI PEMBUATAN MODEL SUPERVISED LEARNING
3.2 Preprocessing Data
• Handling Missing Values:
Menghapus data yang hilang atau menggantinya dengan median/mean.
• Feature Scaling (Normalisasi dan Standardisasi):
• Normalisasi: Mengubah skala fitur ke rentang [0,1].
• Standardisasi: Mengubah fitur ke distribusi dengan mean = 0 dan standar deviasi = 1.
• Encoding Kategori:
Mengubah data kategori menjadi numerik (One-Hot Encoding atau Label Encoding).
• Feature Selection:
Memilih fitur yang paling relevan dengan menggunakan metode statistik atau model.
SUPERVISED LEARNING
3. METODOLOGI PEMBUATAN MODEL SUPERVISED LEARNING
3.3 Pemisahan Dataset
Dataset dibagi menjadi:
• Training Set (70-80%) → Untuk melatih model.
• Testing Set (20-30%) → Untuk menguji model.
SUPERVISED LEARNING
3. METODOLOGI PEMBUATAN MODEL SUPERVISED LEARNING
3.4 Pemilihan Model
• Berdasarkan jenis masalah, kita memilih algoritma yang sesuai:
SUPERVISED LEARNING
3. METODOLOGI PEMBUATAN MODEL SUPERVISED LEARNING
3.5 Pelatihan Model
Model dilatih dengan data training untuk menemukan pola dalam data.
• Contoh Klasifikasi dengan Decision Tree:
• Contoh Klasifikasi dengan Linear Regression:
SUPERVISED LEARNING
3. METODOLOGI PEMBUATAN MODEL SUPERVISED LEARNING
3.6 Evaluasi Model
Setelah model dilatih, performanya dievaluasi dengan metrik evaluasi.
• Evaluasi Klasifikasi:
1. Akurasi
2. Precision, Recall, dan F1-Score:
SUPERVISED LEARNING
3. METODOLOGI PEMBUATAN MODEL SUPERVISED LEARNING
Evaluasi Regresi:
1. Mean Absolute Error (MAE):
2. Mean Squared Error (MSE):
3. R-Squared (R² Score)
SUPERVISED LEARNING
3. METODOLOGI PEMBUATAN MODEL SUPERVISED LEARNING
3.7 Hyperparameter Tuning
Menyesuaikan parameter model untuk mendapatkan performa optimal.
• Contoh Tuning Decision Tree dengan Grid Search:
SUPERVISED LEARNING
3. METODOLOGI PEMBUATAN MODEL SUPERVISED LEARNING
3.8 Deployment Model
Model yang sudah diuji dapat digunakan dalam aplikasi.
1. Menyimpan model dengan Pickle:
SUPERVISED LEARNING
3. METODOLOGI PEMBUATAN MODEL SUPERVISED LEARNING
2. Memuat model untuk digunakan
3. Menerapkan model pada data baru
SUPERVISED LEARNING - CLASSIFICATION
K-NEAREST NEIGHBORS (KNN)
SUPERVISED LEARNING - CLASSIFICATION
K-NEAREST NEIGHBORS (KNN)
SUPERVISED LEARNING - CLASSIFICATION
K-NEAREST NEIGHBORS (KNN)
SUPERVISED LEARNING - CLASSIFICATION
K-NEAREST NEIGHBORS (KNN)
• Ilustrasi KNN dengan
nilai k = 3 dan nilai k = 6
• Untuk k = 3, prediksi
data baru yang dihasilkan
adalah masuk Class B,
sedangkan jika k = 6, data
baru masuk Class A
SUPERVISED LEARNING - CLASSIFICATION
K-NEAREST NEIGHBORS (KNN)
SUPERVISED LEARNING - CLASSIFICATION
K-NEAREST NEIGHBORS (KNN)
SUPERVISED LEARNING - CLASSIFICATION
WEIGHTED K-NEAREST NEIGHBORS (WKNN)
SUPERVISED LEARNING - CLASSIFICATION
WEIGHTED K-NEAREST NEIGHBORS (WKNN)
SUPERVISED LEARNING - CLASSIFICATION
DECISION TREE
SUPERVISED LEARNING - CLASSIFICATION
DECISION TREE
SUPERVISED LEARNING - CLASSIFICATION
DECISION TREE
SUPERVISED LEARNING - CLASSIFICATION
DECISION TREE
SUPERVISED LEARNING - CLASSIFICATION
DECISION TREE
SUPERVISED LEARNING - CLASSIFICATION
DECISION TREE
SUPERVISED LEARNING - CLASSIFICATION
DECISION TREE
SUPERVISED LEARNING - CLASSIFICATION
DECISION TREE
SUPERVISED LEARNING - CLASSIFICATION
DECISION TREE
SUPERVISED LEARNING - CLASSIFICATION
DECISION TREE
SUPERVISED LEARNING - CLASSIFICATION
DECISION TREE
SUPERVISED LEARNING - CLASSIFICATION
NAÏVE BAYES
SUPERVISED LEARNING - CLASSIFICATION
NAÏVE BAYES
SUPERVISED LEARNING - CLASSIFICATION
NAÏVE BAYES
SUPERVISED LEARNING - CLASSIFICATION
MULTINOMIAL NAÏVE BAYES
SUPERVISED LEARNING - CLASSIFICATION
GAUSSIAN NAÏVE BAYES
SUPERVISED LEARNING - CLASSIFICATION
PERBANDINGAN GAUSSIAN VS. MULTINOMIAL NAÏVE BAYES