Search engine for discovering works of Art, research articles, and books related to Art and Culture
ShareThis
Javascript must be enabled to continue!

Komparasi Metode SMOTE-Tomek dan SMOTE-ENN untuk Mengatasi Data Imbalanced

View through CrossRef
Perkembangan teknologi informasi dan data analisis saat ini mendorong meningkatnya pemanfaatan machine learning dalam berbagai bidang. Namun, salah satu permasalahan umum yang sering muncul dalam penerapan machine learning adalah kondisi data tidak seimbang (imbalanced data) yaitu ketidakseimbangan jumlah data antar kelas, di mana kelas mayoritas jauh lebih dominan dibandingkan kelas minoritas. Untuk mengatasi permasalahan dataset tidak seimbang adalah dengan menyeimbangkan distribusi kelas tidak seragam di antara kelas-kelas dengan komparasi menggunakan metode SMOTE-Tomek dan SMOTE-ENN supaya jumlahnya seimbang dari kelas mayoritas (negatif) maupun kelas minoritas (positif). Berdasarkan hasil eksperimen yang telah dilakukan dari penelitian ini yaitu bahwa pengujian metode SMOTE-Tomek dengan metode klasifikasi mampu menangani jumlah kelas mayoritas (negatif) dan kelas minoritas (positif) pada data tidak seimbang dengan menghasilkan nilai MCC dan G-mean mencapai kinerja prediksi yang lebih besar dibandingkan dengan menggunakan metode klasifikasi saja maupun menggunakan Metode SMOTE-ENN. Kemudian untuk dataset Binary nilai MCC dan G-mean yang paling tinggi menggunakan SMOTE-ENN + Random Forest dengan nilai tertinggi MCC = 0.99 dan nilai G-mean = 0.99 dari nilai MCC dan G-mean diatas akurasinya sudah bagus karena nilai MCC dan G-mean yang mendekati 1 menunjukkan bahwa model memiliki performa klasifikasi yang sangat baik dalam menangani data tidak seimbang dengan menggunakan Metode SMOTE-Tomek + Random Forest dapat mencapai kinerja prediksi yang lebih besar untuk menangani dataset tidak seimbang Binary. Hal tersebut menunjukkan bahwa proses penanganan terhadap distribusi kelas yang tidak seimbang pada tahap preprocessing data memberikan pengaruh terhadap nilai akurasi MCC maupun G-mean metode SMOTE-Tomek + Random Forest.
Title: Komparasi Metode SMOTE-Tomek dan SMOTE-ENN untuk Mengatasi Data Imbalanced
Description:
Perkembangan teknologi informasi dan data analisis saat ini mendorong meningkatnya pemanfaatan machine learning dalam berbagai bidang.
Namun, salah satu permasalahan umum yang sering muncul dalam penerapan machine learning adalah kondisi data tidak seimbang (imbalanced data) yaitu ketidakseimbangan jumlah data antar kelas, di mana kelas mayoritas jauh lebih dominan dibandingkan kelas minoritas.
Untuk mengatasi permasalahan dataset tidak seimbang adalah dengan menyeimbangkan distribusi kelas tidak seragam di antara kelas-kelas dengan komparasi menggunakan metode SMOTE-Tomek dan SMOTE-ENN supaya jumlahnya seimbang dari kelas mayoritas (negatif) maupun kelas minoritas (positif).
Berdasarkan hasil eksperimen yang telah dilakukan dari penelitian ini yaitu bahwa pengujian metode SMOTE-Tomek dengan metode klasifikasi mampu menangani jumlah kelas mayoritas (negatif) dan kelas minoritas (positif) pada data tidak seimbang dengan menghasilkan nilai MCC dan G-mean mencapai kinerja prediksi yang lebih besar dibandingkan dengan menggunakan metode klasifikasi saja maupun menggunakan Metode SMOTE-ENN.
Kemudian untuk dataset Binary nilai MCC dan G-mean yang paling tinggi menggunakan SMOTE-ENN + Random Forest dengan nilai tertinggi MCC = 0.
99 dan nilai G-mean = 0.
99 dari nilai MCC dan G-mean diatas akurasinya sudah bagus karena nilai MCC dan G-mean yang mendekati 1 menunjukkan bahwa model memiliki performa klasifikasi yang sangat baik dalam menangani data tidak seimbang dengan menggunakan Metode SMOTE-Tomek + Random Forest dapat mencapai kinerja prediksi yang lebih besar untuk menangani dataset tidak seimbang Binary.
Hal tersebut menunjukkan bahwa proses penanganan terhadap distribusi kelas yang tidak seimbang pada tahap preprocessing data memberikan pengaruh terhadap nilai akurasi MCC maupun G-mean metode SMOTE-Tomek + Random Forest.

Related Results

XGBoost for Educational Performance: Comparing SMOTE and SMOTE-TOMEK on Imbalanced Data
XGBoost for Educational Performance: Comparing SMOTE and SMOTE-TOMEK on Imbalanced Data
Class imbalance poses a critical challenge in educational performance prediction, particularly in accurately identifying at-risk students within small datasets. This study rigorous...
FAKTOR-FAKTOR YANG MEMPENGARUHI MORTALITAS PADA PASIEN DENGAN FRAKTUR COSTA: Literature Review
FAKTOR-FAKTOR YANG MEMPENGARUHI MORTALITAS PADA PASIEN DENGAN FRAKTUR COSTA: Literature Review
FAKTOR-FAKTOR YANG MEMPENGARUHI MORTALITAS PADA PASIEN DENGAN FRAKTUR COSTA: Literature  Review Anna Tri Wahyuni1), Masfuri2),  Liya Arista3)1,2,3 Fakultas Ilmu Keperawatan Univers...
Advanced Re-Sampling Techniques for Multi-Class Imbalanced Classification
Advanced Re-Sampling Techniques for Multi-Class Imbalanced Classification
Imbalanced classification is a common problem in machine learning, where one class significantly outnumbers the others. This imbalance leads to biased model performance, where the ...
KECEMASAN SAAT PANDEMI COVID 19: LITERATUR REVIEW Hardiyati, Efri Widianti, Taty Hernawaty Departemen Keperawatan Jiwa Poltekkes Kemenkes Mamuju Sulbar, Universitas Pad...
Ensemble learning with imbalanced data handling in the early detection of capital markets
Ensemble learning with imbalanced data handling in the early detection of capital markets
Research aims: This study aims to create an early detection model to predict events in the Indonesian capital market.Design/Methodology/Approach: A quantitative study comparing ens...
Klasifikasi Data Tak Seimbang menggunakan Algoritma Random Forest dengan SMOTE dan SMOTE-ENN (Studi Kasus pada Data Stunting)
Klasifikasi Data Tak Seimbang menggunakan Algoritma Random Forest dengan SMOTE dan SMOTE-ENN (Studi Kasus pada Data Stunting)
Algoritma random forest merupakan salah satu metode klasifikasi pembelajaran mesin yang banyak digunakan karena memiliki keunggulan dalam mengurangi resiko overfitting sekaligus me...
Klasifikasi Data Tak Seimbang Menggunakan Algoritma Random Forest dengan SMOTE dan SMOTE-ENN
Klasifikasi Data Tak Seimbang Menggunakan Algoritma Random Forest dengan SMOTE dan SMOTE-ENN
Algoritma random forest merupakan salah satu metode klasifikasi mesin pembelajaran yang banyak digunakan karena memiliki keunggulan dalam mengurangi risiko overfitting sekaligus me...
Comparative analysis of resampling algorithms in the prediction of stroke diseases
Comparative analysis of resampling algorithms in the prediction of stroke diseases
Stroke disease is a serious cause of death globally. Early predictions of the disease will save a lot of lives but most of the clinical datasets are imbalanced in nature including ...

Back to Top