tugas
Tugas 3: Penerapan Ensemble Learning Menggunakan Algoritma Random Forest
Tugas 3: Penerapan Ensemble Learning Berbasis Random Forest
Eksperimen pemodelan ensemble learning metode Random Forest untuk meningkatkan generalisasi model, mereduksi variansi (variance reduction), dan mengatasi kelemahan instabilitas pohon keputusan tunggal.
1. Prinsip Kerja Ensemble Bagging dan Random Subspace
Random Forest menggabungkan puluhan hingga ratusan pohon keputusan independen yang dilatih menggunakan dua mekanisme pengacakan utama:
- Bootstrap Aggregating (Bagging): Setiap pohon dibangun dari sampel acak berukuran yang ditarik dengan pengembalian (sampling with replacement) dari dataset latih asli.
- Random Feature Subspace: Pada setiap pemisahan simpul (node splitting), hanya sebagian kecil acak dari total fitur yang dipertimbangkan (lazimnya untuk klasifikasi), memaksa pohon mengeksplorasi fitur-fitur alternatif yang berbeda.
- Agregasi Prediksi: Prediksi akhir ditentukan melalui majority voting untuk tugas klasifikasi atau nilai rata-rata (mean average) untuk tugas regresi:
2. Evaluasi Out-of-Bag (OOB) dan Feature Importance
Model dievaluasi menggunakan sampel Out-of-Bag (OOB) sebagai validasi internal tanpa memerlukan pemisahan dataset validasi terpisah. Kepentingan relatif setiap fitur (Mean Decrease Impurity) dihitung untuk mengidentifikasi atribut yang paling berpengaruh terhadap akurasi model.
3. Berkas Tugas Terlampir
- Jupyter Notebook komprehensif:
random-forest-ensemble.ipynbyang memuat tuning hyperparametern_estimators,max_features, dan grafik peringkat fitur terpenting.