KLASIFIKASI KESESUAIAN BIDANG PELATIHAN CALON TENAGA KERJA MENGGUNAKAN INFORMATION GAIN DAN RANDOM FOREST

Authors

  • Rika Nofitri Universitas Royal, Indonesia Author
  • Suparmadi Suparmadi Universitas Royal, Indonesia Author
  • Cecep Maulana Universitas Royal, Indonesia Author

DOI:

https://doi.org/10.54314/jssr.v9i4.7114

Keywords:

Information Gain, Random Forest, Feature Selection, Training Field Classification, RapidMiner

Abstract

Abstract: Selecting appropriate vocational training fields for prospective workers at Job Training Centers (BLK) is critical for optimizing skill development and ensuring job market alignment. However, manual selection processes and high-dimensional datasets containing irrelevant candidate attributes often lead to classification inaccuracies and computational noise. This study proposes an optimized classification model combining the Information Gain (IG) feature selection method with the Random Forest algorithm to enhance prediction accuracy for training field suitability. Using a dataset of 233 candidate records, feature weighting was executed via Information Gain to eliminate redundant demographic attributes. The feature selection identified four dominant predictors: Academic Potential Test (TPA) score, interview score, vocational skill score, and BLK training choice. Experimental evaluation was conducted using a 70:30 train-test split in RapidMiner Studio. The experimental results demonstrate that applying Information Gain reduced the feature space from nine to four attributes, increasing classification accuracy from 87.14% (baseline Random Forest) to 90.00% (+2.86%). Furthermore, the model achieved a notable precision enhancement, rising from 86.96% to 93.44% (+6.48%), and an improved F1-Score of 94.21%. These findings confirm that removing non-contributing demographic variables mitigates dataset noise and enables Random Forest to form more effective decision boundaries. The optimized model offers a robust, objective framework to support decision-making systems in candidate placement at vocational training institutions.

Keywords: Information Gain, Random Forest, Feature Selection, Training Field Classification, RapidMiner.

 

Abstrak: Penentuan bidang pelatihan vokasi yang tepat bagi calon peserta di Balai Latihan Kerja (BLK) sangat krusial untuk mengoptimalkan pengembangan keterampilan dan kesesuaian dengan kebutuhan pasar kerja. Namun, proses seleksi manual dan tingginya dimensi dataset yang memuat atribut kandidat kurang relevan sering kali menyebabkan ketidakakuratan klasifikasi serta noise komputasi. Penelitian ini mengusulkan model klasifikasi teroptimasi yang menggabungkan metode seleksi fitur Information Gain (IG) dengan algoritma Random Forest untuk meningkatkan akurasi prediksi kesesuaian bidang pelatihan. Menggunakan dataset sebanyak 233 data calon peserta, pembobotan fitur dieksekusi melalui Information Gain untuk mengeliminasi atribut demografis yang redundan. Hasil seleksi fitur berhasil mengidentifikasi empat prediktor dominan: nilai Tes Potensi Akademik (TPA), nilai wawancara, nilai kejuruan, dan pilihan BLK. Evaluasi eksperimental dilakukan dengan pembagian data train-test sebesar 70:30 pada perangkat lunak RapidMiner Studio. Hasil pengujian membuktikan bahwa penerapan Information Gain yang mereduksi ruang fitur dari sembilan menjadi empat atribut mampu meningkatkan akurasi klasifikasi dari 87,14% (model awal Random Forest) menjadi 90,00% (+2,86%). Selain itu, model ini mencapai peningkatan presisi yang signifikan, naik dari 86,96% menjadi 93,44% (+6,48%), serta kenaikan F1-Score menjadi 94,21%. Temuan ini mengonfirmasi bahwa penghapusan variabel demografis yang tidak berkontribusi berhasil mengurangi noise data dan memungkinkan Random Forest membentuk pohon keputusan yang lebih efektif. Model teroptimasi ini memberikan kerangka kerja yang objektif dan andal untuk mendukung sistem pengambilan keputusan dalam penempatan calon peserta di lembaga pelatihan vokasi.

Kata kunci: Information Gain, Random Forest, Seleksi Fitur, Klasifikasi Bidang Pelatihan, RapidMiner.

Downloads

Download data is not yet available.

References

Amaliah, S., Nusrang, M., & Aswi, A. (2022). Penerapan metode Random Forest untuk klasifikasi varian minuman kopi di Kedai Kopi Konijiwa Bantaeng. VARIANSI: Journal of Statistics and Its Application in Teaching and Research, 4(3), 121–127. https://doi.org/10.35580/variansiunm31

Firana, N. A., Afrianty, I., Novriyanto, N., & Yanto, F. (2026). Information Gain and Random Forest for sex classification based on craniometric measurements. Journal of Artificial Intelligence and Software Engineering, 6(2), 118–129. https://doi.org/10.30811/jaise.v6i2.9409

Irwansya, I., Ramadhan, S., & Lorosae, T. A. (2024). Perancangan sistem informasi pencari kerja pada Dinas Tenaga Kerja dan Transmigrasi Kabupaten Kep. Sula Propinsi Maluku Utara menggunakan Visual Basic.Net. Jurnal Mediatik, 7(2), 107–113. https://doi.org/10.59562/mediatik.v7i2.1304

Ramadhan, S., et al. (2025). Penerapan metode Random Forest dalam mengklasifikasi. Jurnal Penelitian Komputer, 9(6), 9433–9440.

Saputra, I. E., & Sarnawa, B. (2022). Peran Dinas Tenaga Kerja dalam perlindungan terhadap hak-hak atas upah pekerja. Media Law Sharia, 3(4), 284–300. https://doi.org/10.18196/mls.v3i4.14330

Downloads

Published

2026-08-31

How to Cite

KLASIFIKASI KESESUAIAN BIDANG PELATIHAN CALON TENAGA KERJA MENGGUNAKAN INFORMATION GAIN DAN RANDOM FOREST. (2026). JOURNAL OF SCIENCE AND SOCIAL RESEARCH, 9(4), 6973-6978. https://doi.org/10.54314/jssr.v9i4.7114

Most read articles by the same author(s)

<< < 1 2 3 4 > >>