Tugas UTS.
Regularization & Hyperparameter Tuning
Artificial Neural Network (ANN) dengan TensorFlow
Durasi: 2 pekan
Tugas ini dikerjakan secara individu dan mendapat porsi 50% dari nilai tugas (bobot 20%
terhadap nilai akhir mata kuliah)
Mahasiswa diminta membangun model Artificial Neural Network (ANN) menggunakan
TensorFlow/Keras untuk klasifikasi dataset Fashion MNIST, dengan mengacu pada tutorial
dasar TensorFlow [Link] Model yang
digunakan harus berupa fully connected (Dense layers), tidak diperkenankan menggunakan
CNN, RNN, atau arsitektur lanjutan lainnya.
Tahapan yang dilakukan:
1. Melakukan preprocessing data, termasuk normalisasi dan pembagian dataset menjadi
training, validation (dev), dan test set, serta menjelaskan kaitannya dengan evaluasi
model.
2. Membangun model baseline ANN sederhana sebagai acuan awal.
3. Melakukan eksplorasi hyperparameter menggunakan pendekatan coarse-to-fine
grained search, yaitu:
o tahap awal mengeksplorasi rentang nilai yang luas (coarse),
o dilanjutkan dengan pencarian lebih detail pada area terbaik (fine),
o serta memberikan justifikasi pemilihan rentang dan hasil terbaik.
4. Menguji beberapa hyperparameter utama, masing-masing harus divariasikan (sebagai
panduan cara memvariasikannya, lihat materi pada slide). Hyperparameter yang
divariasikan:
1) jumlah layer dan neuron,
2) activation function,
3) learning rate,
4) batch size (mini-batch),
5) jumlah epoch.
5. Menerapkan teknik regularization (misalnya dropout, L2, atau early stopping) dan
menganalisis pengaruhnya terhadap overfitting dan underfitting (bias–variance).
6. Mengimplementasikan Batch Normalization dan membandingkan performanya dengan
model tanpa Batch Normalization.
7. Mencoba variasi weight initialization (misalnya default vs He initialization) dan
menganalisis pengaruhnya terhadap proses training.
8. Membandingkan beberapa optimizer (misalnya SGD, SGD + momentum, dan Adam),
termasuk analisis kecepatan konvergensi dan stabilitas training.
9. Menganalisis pengaruh batch size (mini-batch) terhadap stabilitas training, waktu
komputasi, dan generalisasi model.
10. Menyajikan hasil eksperimen dalam bentuk tabel dan grafik (loss dan accuracy), serta
melakukan analisis:
o identifikasi overfitting atau underfitting,
o penentuan konfigurasi terbaik,
o faktor yang paling berpengaruh terhadap performa.
11. Mengevaluasi model terbaik pada test set dan melaporkan metrik performa serta contoh
prediksi.
Output yang dikumpulkan:
• File kode (.ipynb atau .py) dengan komentar yang jelas
• Laporan PDF berisi metode, eksperimen, hasil, dan analisis
Rubrik penilaian
Aspek Penilaian 4 (Sangat Baik) 3 (Baik) 2 (Cukup) 1 (Kurang)
Implementasi Seluruh pipeline Pipeline berjalan Pipeline tidak Program tidak
Program (30%) (preprocessing, dengan sedikit lengkap atau berjalan atau
model, training, kekurangan terdapat error tidak sesuai
evaluasi) berjalan minor, namun yang ketentuan (misal
sempurna tanpa masih sesuai mempengaruhi bukan ANN)
error, sesuai tujuan hasil
ketentuan ANN
Eksperimen Menggunakan Ada eksplorasi Eksperimen Hampir tidak ada
Hyperparameter coarse-to-fine cukup dan mulai terbatas dan eksplorasi atau
(20%) search secara terarah, namun kurang hanya mencoba 1–
sistematis, variasi belum optimal sistematis, 2 konfigurasi
luas dan detail, dalam tanpa strategi
dengan justifikasi penyempitan jelas
kuat pencarian
Regularization & Membandingkan Mengimplementas Hanya Tidak
Optimization beberapa metode ikan dan implementasi mengimplementas
(20%) (regularization & membandingkan tanpa ikan atau tidak
optimizer) dengan metode, namun perbandingan relevan
analisis mendalam analisis masih yang jelas
dan tepat terbatas
Analisis Hasil Analisis mendalam Analisis cukup Analisis Tidak ada analisis
(20%) dan kritis, mampu jelas, namun deskriptif saja, atau hanya
mengaitkan bias– belum tanpa menampilkan
variance, menyeluruh atau interpretasi yang hasil
overfitting/underfittin kurang kuat
g, dan faktor utama mendalam
performa
Kualitas Notebook sangat Notebook rapi dan Penjelasan Tidak ada
Notebook & rapi, Markdown jelas, cukup jelas, minim, struktur penjelasan atau
Dokumentasi alur logis, semua namun masih ada kurang jelas sulit dipahami
(10%) output Run All bagian kurang
lengkap terstruktur