Jurnal Komtika (Komputasi dan Informatika)

Articles

Perbandingan Kinerja Algoritma Machine Learning pada Sentimen #KaburAjaDulu dengan Penanganan Ketidakseimbangan Data Menggunakan SMOTE

Alisha Sumahesa , Cahyono Budy Santoso

Abstrak

The phenomenon of labor migration abroad has become a widely discussed social issue on social media, particularly through the hashtag #KaburAjaDulu on the X platform. This study aims to analyze public sentiment toward the phenomenon using machine learning classification methods with the implementation of Synthetic Minority Over-sampling Technique (SMOTE) to address data imbalance. The research was conducted using 1,750 data collected from the X platform through several stages, including data collection, text preprocessing, sentiment labeling, TF-IDF weighting, SMOTE implementation, and classification using Support Vector Machine (SVM), Naive Bayes, Random Forest, and Logistic Regression algorithms. Model evaluation was carried out using accuracy, precision, recall, and f1-score metrics. The results show that the implementation of SMOTE significantly improved classification performance. Logistic Regression achieved the best performance with an accuracy of 91.36%, followed by Random Forest at 90.30%, Support Vector Machine at 88.89%, and Naive Bayes at 82.89%. These findings indicate that Logistic Regression has the best capability in recognizing sentiment patterns within unstructured social media data. This study proves that data balancing using SMOTE plays an important role in improving sentiment classification performance and in understanding public opinion regarding social phenomena developing in digital media.

Keywords

Analisis Sentimen; Machine learning; SMOTE; Support Vector Machine; Logistic Regression

Referensi

  1. [1] Ravenstein, “Analisis Faktor-Faktor yang Mempengaruhi Tingkat Migrasi Tenaga Kerja Indonesia (TKI) (Studi Kasus Pada 6 Provinsi Tahun 2008-2017),” FEB UIN Syarif Hidayatullah, 2019, [Online]. Available: http://repository.uinjkt.ac.id/dspace/handle/123456789/46978
  2. [2] P. Nandwani and R. Verma, “A review on sentiment analysis and emotion detection from text,” Soc. Netw. Anal. Min., vol. 11, no. 1, pp. 1–19, 2021, doi: 10.1007/s13278-021-00776-6.
  3. [3] E. R. Kaburuan and N. R. Setiawan, “Sentimen Analisis Review Aplikasi Digital Korlantas Pada Google Play Store Menggunakan Metode SVM,” J. Sisfokom (Sistem Inf. dan Komputer), vol. 12, no. 1, pp. 105–116, 2023, doi: 10.32736/sisfokom.v12i1.1614.
  4. [4] A. Firdaus and W. I. Firdaus, “Text Mining Dan Pola Algoritma Dalam Penyelesaian Masalah Informasi : (Sebuah Ulasan),” J. JUPITER, vol. 13, no. 1, p. 66, 2021.
  5. [5] R. C. Rivaldi, T. D. Wismarini, J. T. Lomba, and J. Semarang, “Analisis Sentimen Pada Ulasan Produk Dengan Metode Natural Language Processing (NLP) (Studi Kasus Zalika Store 88 Shopee),” Elkom, vol. 17, no. 1, pp. 120–128, 2024.
  6. [6] H. C. Husada and A. S. Paramita, “Analisis Sentimen Pada Maskapai Penerbangan di Platform Twitter Menggunakan Algoritma Support Vector Machine (SVM),” Teknika, vol. 10, no. 1, pp. 18–26, 2021, doi: 10.34148/teknika.v10i1.311.
  7. [7] Muhammad Fernanda Naufal Fathoni, Eva Yulia Puspaningrum, and Andreas Nugroho Sihananto, “Perbandingan Performa Labeling Lexicon InSet dan VADER pada Analisa Sentimen Rohingya di Aplikasi X dengan SVM,” Modem J. Inform. dan Sains Teknol., vol. 2, no. 3, pp. 62–76, 2024, doi: 10.62951/modem.v2i3.112.
  8. [8] O. I. Gifari, M. Adha, F. Freddy, and F. F. S. Durrand, “Analisis Sentimen Review Film Menggunakan TF-IDF dan Support Vector Machine,” J. Inf. Technol., vol. 2, no. 1, pp. 36–40, 2022, doi: 10.46229/jifotech.v2i1.330.
  9. [9] P. P. Putra, M. K. Anam, A. S. Chan, A. Hadi, N. Hendri, and A. Masnur, “Optimizing Sentiment Analysis on Imbalanced Hotel Review Data Using SMOTE and Ensemble Machine Learning Techniques,” J. Appl. Data Sci., vol. 6, no. 2, pp. 936–951, 2025, doi: 10.47738/jads.v6i2.618.
  10. [10] D. Valkenborg, A. J. Rousseau, M. Geubbelmans, and T. Burzykowski, “Support vector machines,” Am. J. Orthod. Dentofac. Orthop., vol. 164, no. 5, pp. 754–757, 2023, doi: 10.1016/j.ajodo.2023.08.003.
  11. [11] M. F. As Shidiq and D. Alita, “Analisis Sentimen Masyarakat Terhadap Kasus Judi Online Menggunakan Data Dari Media Sosial X Pendekatan Naive Bayes Dan Svm,” J. Sist. Inf. dan Inform., vol. 8, no. 1, pp. 24–35, 2025, doi: 10.47080/simika.v8i1.3624.
  12. [12] H. Hairani, T. Widiyaningtyas, and D. D. Prasetya, “Addressing Class Imbalance of Health Data: a Systematic Literature Review on Modified Synthetic Minority Oversampling Technique (SMOTE) Strategies,” Int. J. Informatics Vis., vol. 8, no. 3, pp. 1310–1318, 2024, doi: 10.62527/joiv.8.3.2283.
  13. [13] A. A. Qolbu, N. Fitriyati, and N. Inayah, “Performa Naïve Bayes , SVM , dan IndoBERT pada Analisis Sentimen Twitter IndiHome dengan Strategi Penanganan Data Tidak Seimbang,” J. Fourier, vol. 814, no. 1, pp. 29–44, 2025, doi: 10.14421/fourier.2025.141.29-44.
  14. [14] U. Hasanah, A. M. Soleh, and K. Sadik, “Effect of Random Under sampling, Oversampling, and SMOTE on the Performance of Cardiovascular Disease Prediction Models,” J. Mat. Stat. dan Komputasi, vol. 21, no. 1, pp. 88–102, 2024, doi: 10.20956/j.v21i1.35552.
  15. [15] E. Erlin, Y. Desnelita, N. Nasution, L. Suryati, and F. Zoromi, “Dampak SMOTE terhadap Kinerja Random Forest Classifier berdasarkan Data Tidak seimbang,” MATRIK J. Manajemen, Tek. Inform. dan Rekayasa Komput., vol. 21, no. 3, pp. 677–690, 2022, doi: 10.30812/matrik.v21i3.1726.
  16. [16] A. N. Laily, M. A. Barata, and D. Nurdiansyah, “Analisis Klasifikasi Hepatitis Menggunakan Synthetic Minority Oversampling Technique , Support Vector Machine , dan Random Forest,” vol. 6, no. 1, pp. 223–236, 2026.
  17. [17] A. A. Nurrahman, M. Mauladi, and A. Rahman, “Analisis Sentimen Masyarakat terhadap Kenaikan Harga Bahan Bakar Minyak Menggunakan Support Vector Machine dan SMOTE,” sudo J. Tek. Inform., vol. 4, no. 2, pp. 50–56, 2025, doi: 10.56211/sudo.v4i2.908.
  18. [18] Olih Solihin, Dwi Firmansyah, Ahmad Zakki Abdullah, and Ahmad Prawira Dhahiyat, “Pemanfaatan AI dalam Analisis Isi Digital : Studi Kasus Komentar Media Sosial,” J. Pendidik. Dan Ilmu Sos., vol. 3, no. 2, pp. 117–129, 2025, doi: 10.54066/jupendis.v3i2.3141.
  19. [19] W. Nugraha and M. Syarif, “Teknik Weighting untuk Mengatasi Ketidakseimbangan Kelas Pada Prediksi Churn Menggunakan XGBoost, LightGBM, dan CatBoost,” Techno.Com, vol. 22, no. 1, pp. 97–108, 2023, doi: 10.33633/tc.v22i1.7191.

Artikel paling banyak dibaca berdasarkan penulis yang sama