UJIAN TENGAH SEMESTER (TAKE HOME)
SEMESTER GANJIL TAHUN AKADEMIK 2025/2026
Mata Kuliah : Machine Learning / Pembelajaran Mesin
Sifat Ujian : INDIVIDU (UNIK PER MAHASISWA)
Materi : Regresi, K-Means Clustering, Naive Bayes
Bentuk Soal : Analisis Manual & Verifikasi Pemrograman
PETUNJUK PENGERJAAN & INTEGRITAS (WAJIB DIBACA)
1. Unique Answer Policy: Data soal dibangkitkan menggunakan Nomor Induk Mahasiswa (NIM)
Anda. Jawaban antar mahasiswa PASTI BERBEDA. Jika ditemukan jawaban dengan angka yang
sama persis dengan teman, kedua mahasiswa mendapat nilai E (0).
2. AI Policy:
○ DILARANG menggunakan AI (ChatGPT, dll) untuk melakukan perhitungan manual di kertas.
Anda wajib menuliskan langkah perhitungan.
○ DIPERBOLEHKAN menggunakan AI hanya sebagai asisten coding (Python) untuk
memverifikasi jawaban manual Anda.
3. Format Pengumpulan:
○ Jawaban perhitungan manual ditulis tangan di kertas, lalu discan/foto (PDF).
○ Jawaban koding (Python) discreenshot hasilnya dan lampirkan kodenya.
○ Dikumpulkan dalam 1 file PDF dengan nama: UTS_ML_NIM_NAMA.pdf.
SOAL 1: REGRESI LINIER SEDERHANA (Bobot: 40%)
Topik: Membangun model prediksi dari data unik dan membandingkan perhitungan manual vs mesin.
A. Pembangkitan Data (Data Generation)
Ambil 2 digit terakhir NIM Anda. Misalkan NIM Anda IST10238, maka digit A=3 dan B=8 . (Jika
angka 0, ganti dengan 5).
Gunakan angka tersebut untuk melengkapi data berikut:
Sampel ke-(i) Jam Belajar (x) Nilai Ujian (y)
1 2 10 + A
2 4 20 + B
3 5 30 + B
4 7 40 + A
5 8 50 + A + B
B. Pertanyaan
1. Perhitungan Manual (Tulis Tangan):
○ Hitunglah komponen berikut: ∑ x , ∑ y , ∑ xy , ∑ x 2.
○ Hitung nilai Slope ( β 1) dan Intercept ( β 0) menggunakan metode Least Square Error.
○ Tuliskan persamaan regresi liniernya: ^y =β 0 + β 1 x .
○ Prediksi: Berapakah prediksi Nilai Ujian jika seorang mahasiswa belajar selama 6 Jam?
2. Verifikasi Python:
○ Buatlah kode Python sederhana menggunakan sklearn.linear_model.LinearRegression untuk
data di atas.
○ Tampilkan coefficient dan intercept dari hasil Python.
○ Analisis: Apakah hasil hitungan manual Anda sama persis dengan hasil Python? Jika ada
perbedaan desimal, jelaskan mengapa hal itu terjadi.
SOAL 2: K-MEANS CLUSTERING - SIMULASI ITERASI (Bobot: 35%)
Topik: Memahami logika jarak Euclidean dan perpindahan centroid.
A. Pembangkitan Data Koordinat
Anda memiliki 5 titik data ( A , B ,C , D , E). Tentukan koordinat titik A dan B menggunakan NIM Anda:
Misal 3 digit terakhir NIM Anda adalah d 1, d 2, d 3 .
● Titik A = (d 1, d 2)
● Titik B = (d 2, d 3)
● Titik C = (2, 2)
● Titik D = (8, 8)
● Titik E = (1, 8)
B. Pertanyaan (Manual Tulis Tangan)
Simulasikan algoritma K-Means untuk 1 Iterasi saja dengan ketentuan:
1. Inisialisasi: Tetapkan Titik C sebagai Centroid 1 (C 1) dan Titik D sebagai Centroid 2 (C 2).
2. Perhitungan Jarak: Hitung jarak Euclidean dari Titik A, B, dan E ke masing-masing Centroid (C 1
dan C 2). Tuliskan hasilnya dalam tabel.
3. Assignment: Tentukan setiap titik (A, B, E) masuk ke Cluster 1 atau Cluster 2 (pilih jarak terdekat).
4. Update Centroid: Hitung lokasi koordinat Centroid baru (C 1{new } dan C 2{new } ) berdasarkan rata-rata
anggota cluster yang terbentuk.
5. Visualisasi: Gambarkan sketsa grafik kartesius sederhana posisi titik-titik tersebut dan posisi
centroid awal vs centroid baru.
SOAL 3: NAIVE BAYES & INTERPRETASI REGRESI BERGANDA
(Bobot: 25%)
Topik: Logika Probabilitas dan Pemahaman Konsep.
A. Naive Bayes (Studi Kasus)
Buatlah dataset fiktif kecil (Training Data) berisi 6 baris data tentang keputusan "Membeli Laptop
Gaming" (Label: Ya/Tidak).
● Fitur 1: Harga (Mahal/Murah)
● Fitur 2: Spesifikasi (Tinggi/Rendah)
● Syarat: Dataset harus Anda buat sedemikian rupa sehingga:
○ P(Label=Ya) > P(Label=Tidak) (Peluang beli lebih besar).
● Soal: Hitung manual prediksi untuk data baru: X {new } = { Harga: Mahal, Spesifikasi: Tinggi}.
Tunjukkan perhitungan Likelihood dan Posterior-nya.
B. Analisis Regresi Berganda (Tanpa Hitungan)
Seorang peneliti membuat model Regresi Linier Berganda untuk memprediksi Harga Rumah ( Y ) di
sebuah kota. Persamaan yang dihasilkan adalah:
Y =500.000 +2.000( X 1)−50.000 (X 2 )+1.000 (X 3 )
Dimana:
● X 1 : Luas Tanah (m2)
● X 2 : Jarak ke Pusat Kota (km)
● X 3 : Jumlah Kamar Tidur
Pertanyaan:
1. Jelaskan makna angka -50.000 pada variabel X 2 (Jarak ke Pusat Kota). Mengapa nilainya negatif?
Apakah ini masuk akal secara logika bisnis properti?
2. Jika Anda ingin menaikkan harga jual rumah paling cepat, variabel mana yang paling berpengaruh
untuk diubah? Jelaskan alasannya berdasarkan koefisien persamaan di atas.
-- SELAMAT MENGERJAKAN --