Abstract:Abstract: The rapid growth of e-commerce mobile applications has generated large volumes of user reviews, making manual sentiment analysis increasingly impractical. This study aims to compare the effectiveness of three machine…
achine learning algorithms Support Vector Machine (SVM), Random Forest, and Naive Bayes for automated sentiment classification of Indonesian-language mobile application reviews. A dataset of 3,000 user reviews from the RupaRupa application on the Google Play Store was collected and preprocessed through normalization, tokenization, stopword removal, and stemming. TF-IDF vectorization was applied for feature extraction, while the Synthetic Minority Over-sampling Technique (SMOTE) was used to address class imbalance across three sentiment categories: positive, negative, and neutral. The results show that SVM achieved the highest accuracy of 90.02%, while Random Forest obtained the best F1-score of 88.08% when sufficient training data were available. Naive Bayes demonstrated relatively stable performance across varying training data sizes. Furthermore, TF-IDF keyword analysis revealed that negative reviews were primarily associated with delivery issues, technical problems, and pricing concerns. These findings demonstrate the effectiveness of machine learning approaches for sentiment classification and provide practical insights for improving mobile application services.
Keywords: sentiment analysis; machine learning; SMOTE; TF-IDF; text classification
Abstrak: Pertumbuhan pesat aplikasi mobile e-commerce telah menghasilkan volume ulasan pengguna yang sangat besar, sehingga analisis sentimen secara manual menjadi semakin tidak praktis. Penelitian ini bertujuan untuk membandingkan efektivitas tiga algoritma machine learning Support Vector Machine (SVM), Random Forest, dan Naive Bayes dalam melakukan klasifikasi sentimen otomatis terhadap ulasan aplikasi mobile berbahasa Indonesia. Dataset yang digunakan terdiri dari 3.000 ulasan pengguna aplikasi RupaRupa yang dikumpulkan dari Google Play Store. Data kemudian diproses melalui tahapan preprocessing yang meliputi normalisasi, tokenisasi, penghapusan stopword, dan stemming. Ekstraksi fitur dilakukan menggunakan metode Term Frequency–Inverse Document Frequency (TF-IDF), sedangkan ketidakseimbangan kelas ditangani menggunakan Synthetic Minority Over-sampling Technique (SMOTE) pada tiga kategori sentimen, yaitu positif, negatif, dan netral. Hasil penelitian menunjukkan bahwa SVM mencapai tingkat akurasi tertinggi sebesar 90,02%, sementara Random Forest memperoleh nilai F1-score terbaik sebesar 88,08% ketika tersedia data pelatihan yang memadai. Naive Bayes menunjukkan performa yang relatif stabil pada berbagai ukuran data pelatihan. Selain itu, analisis kata kunci berbasis TF-IDF mengungkapkan bahwa ulasan negatif terutama berkaitan dengan masalah pengiriman, kendala teknis aplikasi, dan isu harga. Temuan ini menunjukkan bahwa pendekatan machine learning efektif untuk klasifikasi sentimen serta memberikan wawasan yang bermanfaat dalam meningkatkan kualitas layanan aplikasi mobile.
Kata Kunci: analisis sentimen; pembelajaran mesin; SMOTE; TF-IDF; klasifikasi teks.
Abstract:Abstract: Mental health issues, particularly depression among young adult university students, are often detected late due to stigma and reluctance to seek medical consultation. The objective of this study is to develop…
an early screening model employing machine learning techniques, specifically the random forest algorithm, on a dataset of 268 students (aged 17-29 years; consisting of 98 males and 170 females) within a multicultural educational setting. The principal challenges associated with this dataset are class imbalance and the potential for data leakage from clinical scores. This study implements a rigorous feature selection approach that involves the elimination of depression score features and the utilization of the Synthetic Minority Over-sampling Technique (SMOTE) to balance the training data distribution. Furthermore, a Threshold Tuning strategy is employed to prioritize detection sensitivity (Recall). The findings indicate that reducing the decision threshold to an optimal value of 0.25 led to a substantial enhancement in the recall value, increasing it from 36% (baseline) to 77%. A feature importance analysis was conducted, the results of which indicated that Total Social Connectedness (ToSC) is the most dominant predictor. In summary, the present study corroborates the notion that optimizing sensitivity through threshold tuning is of paramount importance for medical screening. Furthermore, social isolation factors emerge as more significant indicators of depression risk than demographic attributes.
Keywords: data mining; depression; imbalanced data; random forest; smote; threshold tuning
Abstrak: Masalah kesehatan mental, khususnya depresi di kalangan mahasiswa dewasa muda, sering terdeteksi terlambat akibat stigma dan enggan mencari konsultasi medis. Tujuan studi ini adalah mengembangkan model skrining dini menggunakan teknik machine learning, khususnya algoritma random forest, pada dataset 268 mahasiswa (usia 17-29 tahun; terdiri dari 98 laki-laki dan 170 perempuan) dalam lingkungan pendidikan multikultural. Tantangan utama yang terkait dengan dataset ini adalah ketidakseimbangan kelas dan potensi kebocoran data dari skor klinis. Studi ini menerapkan pendekatan seleksi fitur yang ketat, yang melibatkan eliminasi fitur skor depresi dan penggunaan Teknik Over-sampling Minoritas Sintetis (SMOTE) untuk menyeimbangkan distribusi data pelatihan. Selain itu, strategi Penyesuaian Ambang Batas diterapkan untuk memprioritaskan sensitivitas deteksi (Recall). Hasil penelitian menunjukkan bahwa mengurangi ambang batas keputusan ke nilai optimal 0,25 menyebabkan peningkatan signifikan dalam nilai recall, dari 36% (dasar) menjadi 77%. Analisis pentingnya fitur dilakukan, hasilnya menunjukkan bahwa Total Social Connectedness (ToSC) adalah prediktor yang paling dominan. Secara ringkas, studi ini membenarkan bahwa mengoptimalkan sensitivitas melalui penyesuaian ambang batas sangat penting untuk skrining medis. Selain itu, faktor isolasi sosial muncul sebagai indikator risiko depresi yang lebih signifikan daripada atribut demografis.
Kata kunci: penambangan data; depresi; data tidak seimbang; hutan acak; smote; penyesuaian ambang batas
Abstract:Abstract: Accurate forecasts of tea harvest production are important for workforce planning, factory operations, and marketing decisions, yet conventional estimation in plantations often relies on field experience and can…
n be biased and less adaptive to changing conditions. This study aims to develop a Random Forest Regression model to predict tea harvest production at the Bah Butong tea plantation using historical operational and climate-related data. The dataset consists of 60 monthly records (2020–2024) with six predictor variables: rainfall (mm), number of rainy days, pest level, weed level, number of harvested trees and land area. Data were split into 80% training (48 samples) and 20% testing (12 samples). Model hyperparameters were optimized using RandomizedSearchCV with RepeatedKFold cross-validation (5 folds, 3 repeats). The tuned model achieved MSE of 668,980,524.45, RMSE of 25,864.66 kg, MAE of 19,838.69 kg, and MAPE of 7.59% on the test set. The results indicate that the model can provide practical production estimates, with errors averaging about 7–8% of the actual production. Feature importance analysis shows that the number of harvested tea bushes and cultivated area contribute most to predictions. Future work should extend the historical period and incorporate time-based features (seasonality/lag) for improved forecasting.
Keywords: hyperparameter tuning; production prediction; random forest; regression; tea harvest
Abstrak: Perkiraan akurat produksi panen teh sangat penting untuk perencanaan tenaga kerja, operasional pabrik, dan keputusan pemasaran, namun estimasi konvensional di perkebunan seringkali bergantung pada pengalaman lapangan dan dapat bias serta kurang adaptif terhadap perubahan kondisi. Studi ini bertujuan untuk mengembangkan model Regresi Random Forest untuk memprediksi produksi panen teh di perkebunan teh Bah Butong menggunakan data operasional dan data terkait iklim historis. Dataset terdiri dari 60 catatan bulanan (2020–2024) dengan enam variabel prediktor: curah hujan (mm), jumlah hari hujan, tingkat hama, tingkat gulma, jumlah pokok panen, dan luas lahan. Data dibagi menjadi 80% data pelatihan (48 sampel) dan 20% data pengujian (12 sampel). Parameter model dioptimalkan menggunakan RandomizedSearchCV dengan validasi silang RepeatedKFold (5 lipatan, 3 pengulangan). Model yang telah disempurnakan mencapai MSE sebesar 668.980.524,45, RMSE sebesar 25.864,66 kg, MAE sebesar 19.838,69 kg, dan MAPE sebesar 7,59% pada set data uji. Hasil tersebut menunjukkan bahwa model dapat memberikan estimasi produksi yang praktis, dengan kesalahan rata-rata sekitar 7–8% dari produksi aktual. Analisis kepentingan fitur menunjukkan bahwa jumlah semak teh yang dipanen dan luas lahan budidaya paling berkontribusi pada prediksi. Pekerjaan selanjutnya harus memperpanjang periode historis dan menggabungkan fitur berbasis waktu (musiman/lag) untuk peramalan yang lebih baik.
Kata kunci: panen teh; prediksi produksi; random forest; regresi; tuning parameter
Abstract:Abstract: Managing fast-moving drug inventory requires accurate supplier selection to ensure product availability and minimize the risk of overstock and out-of-stock conditions. At Annisa Pharmacy, the supplier selection…
process has traditionally relied on experience and subjective judgment, which may lead to less optimal decisions. This study aims to design and implement a Decision Support System (DSS) for selecting fast-moving drug suppliers using the Weighted Product (WP) method. The WP method is applied because it is capable of processing multiple criteria simultaneously through structured weighting, including demand frequency, delivery lead time, remaining shelf life, purchase price, and profit margin. The system is developed as a web-based application using PHP and MySQL. The results show that the implementation of the Weighted Product method successfully produces preference values and accurate supplier rankings, enabling the system to correctly determine the most optimal fast-moving drug supplier based on the defined criteria. Therefore, the developed system can assist the owner of Annisa Pharmacy in making more precise, objective, and structured inventory procurement decisions.
Keywords: decision support system; drug inventory; supplier selection; weighted product.
Abstrak: Pengelolaan stok obat fast moving di Toko Obat Annisa memerlukan ketepatan dalam menentukan supplier agar ketersediaan obat tetap terjaga dan risiko overstock maupun out of stock dapat diminimalkan. Selama ini, proses pemilihan supplier masih dilakukan secara konvensional berdasarkan pengalaman, sehingga berpotensi menghasilkan keputusan yang kurang optimal. Penelitian ini bertujuan untuk merancang dan mengimplementasikan Sistem Pendukung Keputusan (SPK) pemilihan supplier obat fast moving menggunakan metode Weighted Product (WP). Metode WP digunakan karena mampu mengolah beberapa kriteria secara simultan melalui pembobotan yang terstruktur, meliputi frekuensi permintaan, lead time, sisa masa kedaluwarsa, harga beli, dan margin keuntungan. Sistem dikembangkan berbasis web menggunakan bahasa pemrograman PHP dan basis data MySQL. Hasil penelitian menunjukkan bahwa penerapan metode Weighted Product mampu menghasilkan nilai preferensi dan perankingan supplier secara objektif, sehingga sistem berhasil menentukan supplier obat fast moving yang paling optimal sesuai dengan kriteria yang telah ditetapkan. Dengan demikian, sistem yang dibangun dapat membantu pemilik Toko Obat Annisa dalam mengambil keputusan pengadaan stok obat secara lebih tepat, objektif, dan terstruktur.
Kata kunci: sistem pendukung keputusan; toko obat; pemilihan pemasok; weighted product
Abstract:Abstract: The development of information technology encourages retail businesses to manage customer and transaction data more effectively. However, many small-scale retailers still rely on manual record-keeping, resulting…
g in unintegrated data and limited decision-making support. This study aims to design and implement a web-based Electronic Customer Relationship Management (E-CRM) system called MySaffana for Saffana Gallery Boutique to optimize customer and transaction data management. The research method includes requirement analysis, system design using UML, implementation using PHP and MySQL, and system testing using black box testing. The results show that the MySaffana system is able to manage customer data, products, transactions, and sales reports in an integrated and efficient manner. System testing indicates that all main features function properly and meet user requirements. Therefore, the developed E-CRM system provides an effective and practical solution for strengthening data-driven decision-making in small-scale retail businesses.
Keywords: boutique; customer data management; customer profiling; E-CRM.
Abstrak: Perkembangan teknologi informasi mendorong usaha ritel untuk mengelola data pelanggan dan transaksi secara lebih efektif. Namun, banyak usaha ritel skala kecil masih melakukan pencatatan secara manual sehingga data tidak terintegrasi dan kurang optimal dalam mendukung keputusan. Penelitian ini bertujuan untuk merancang dan mengimplementasikan sistem Electronic Customer Relationship Management (E-CRM) berbasis web bernama MySaffana pada Butik Saffana Gallery yang dapat mengoptimalkan pengelolaan data pelanggan dan transaksi. Metode penelitian meliputi analisis kebutuhan, perancangan sistem menggunakan UML, implementasi dengan PHP dan MySQL, serta pengujian menggunakan metode black box testing. Hasil penelitian menunjukkan bahwa sistem MySaffana mampu mengelola data pelanggan, produk, transaksi, dan laporan penjualan secara terintegrasi dan efisien. Pengujian sistem membuktikan seluruh fitur berjalan sesuai fungsi dan kebutuhan pengguna. Dengan demikian, sistem E-CRM berbasis web ini dapat menjadi solusi yang efektif dalam mendukung pengelolaan data dan pengambilan keputusan berbasis data bagi usaha ritel skala kecil.
Kata kunci: butik; E-CRM; profil pelanggan; pengelolaan data pelanggan.
Abstract:Abstract: Tech Kios Laptop Kisaran is a business engaged in selling used laptops with various brands and specifications to meet customer needs. However, the selection process is still conducted manually and relies on subjective…
jective judgment, which may result in less accurate recommendations. This study aims to design and implement a Decision Support System using the MOORA (Multi-Objective Optimization on the Basis of Ratio Analysis) method to objectively determine the best used laptop. The criteria applied in this study include brand, screen resolution, laptop size, and battery durability. The system was developed through requirement analysis, system design, implementation, and black-box testing. The results show that the system successfully generates rankings based on MOORA preference values. The highest optimization value of 0.4321 was achieved by Lenovo IdeaPad Slim (A04) and Lenovo ThinkPad (A06), indicating that these two alternatives are the best recommended used laptops. Therefore, the developed system enhances the objectivity, effectiveness, and accuracy of the laptop selection process at Tech Kios Laptop Kisaran.
Keywords: decision support system; MOORA; multi criteria; used laptop; recommendation.
Abstrak: Tech Kios Laptop Kisaran merupakan usaha yang bergerak di bidang penjualan laptop bekas dengan berbagai merek dan spesifikasi untuk memenuhi kebutuhan pelanggan. Namun, proses pemilihan laptop masih dilakukan secara manual dan bergantung pada penilaian subjektif, sehingga berpotensi menghasilkan rekomendasi yang kurang akurat. Penelitian ini bertujuan untuk merancang dan mengimplementasikan Sistem Pendukung Keputusan menggunakan metode MOORA (Multi-Objective Optimization on the Basis of Ratio Analysis) guna menentukan laptop bekas terbaik secara objektif. Kriteria yang digunakan dalam penelitian ini meliputi merek, resolusi layar, ukuran laptop, dan ketahanan daya baterai. Pengembangan sistem dilakukan melalui tahapan analisis kebutuhan, perancangan sistem, implementasi, serta pengujian menggunakan metode black-box. Hasil penelitian menunjukkan bahwa sistem mampu menghasilkan peringkat alternatif berdasarkan nilai preferensi MOORA. Nilai optimasi tertinggi sebesar 0,4321 diperoleh oleh Lenovo IdeaPad Slim (A04) dan Lenovo ThinkPad (A06), yang menunjukkan bahwa kedua alternatif tersebut merupakan rekomendasi laptop bekas terbaik. Dengan demikian, sistem yang dikembangkan mampu meningkatkan objektivitas, efektivitas, dan ketepatan dalam proses pemilihan laptop bekas di Tech Kios Laptop Kisaran.
Kata kunci: laptop bekas; MOORA; multi-kriteria; rekomendasi; sistem pendukung keputusan.
Abstract:Abstract: Rehabilitation programs are essential in correctional systems to equip inmates with the skills and behavioral readiness required for social reintegration. However, rehabilitation program assignment in many correctional…
ectional institutions remains dependent on manual and subjective assessments, which may result in inconsistent decisions. This study develops a Random Forest–based prediction system to support objective and data-driven rehabilitation program determination. A quantitative approach was applied using historical inmate data from January 2023 to January 2025, comprising 2,023 records. The research process included data preprocessing, an 80:20 training–testing split, model training, and performance evaluation using accuracy, precision, recall, and F1-score metrics. The results show that the model achieved an accuracy of 86.17% during training in Google Colab and 68.83% when deployed within the application system. This performance gap reflects real-world deployment and computational constraints rather than model failure. The proposed system provides consistent and objective rehabilitation program recommendations, thereby supporting more effective rehabilitation planning and decision-making in correctional institutions.
Keywords: correctional institutions; inmate rehabilitation programs; machine learning; random Forest; prediction system
Abstrak: Program pembinaan narapidana memiliki peran penting dalam sistem pemasyarakatan untuk membekali warga binaan dengan keterampilan serta kesiapan perilaku dalam proses reintegrasi ke masyarakat. Namun, pada banyak lembaga pemasyarakatan, penentuan program pembinaan masih bergantung pada penilaian manual yang bersifat subjektif, sehingga berpotensi menimbulkan ketidakkonsistenan dalam pengambilan keputusan. Penelitian ini mengembangkan sistem prediksi program pembinaan narapidana berbasis algoritma Random Forest guna mendukung pengambilan keputusan yang objektif dan berbasis data. Pendekatan kuantitatif diterapkan menggunakan data historis narapidana periode Januari 2023 hingga Januari 2025 sebanyak 2.023 data. Tahapan penelitian meliputi prapemrosesan data, pembagian data latih dan uji dengan rasio 80:20, pelatihan model, serta evaluasi performa menggunakan metrik akurasi, precision, recall, dan F1-score. Hasil penelitian menunjukkan bahwa model mencapai akurasi sebesar 86,17% pada tahap pelatihan di Google Colab dan 68,83% saat diimplementasikan pada sistem aplikasi. Perbedaan performa tersebut mencerminkan keterbatasan lingkungan operasional, bukan kegagalan model. Secara keseluruhan, sistem yang dikembangkan mampu memberikan rekomendasi program pembinaan yang lebih objektif dan konsisten, sehingga mendukung perencanaan pembinaan yang lebih efektif.
Kata kunci: mesin pembelajaran; program pembinaan narapidana; random Forest; sistem pemasyarakatan; sistem prediksi
Abstract:Abstract: Storage media is an inseparable tool in everyday life. With storage media, users can store important data, both personal and workplace. In addition, in many cases, Indonesian law uses storage media as evidence.…
The Electronic Information and Transactions Law (UU ITE) regulates how the provision of digital evidence can be strong evidence in court. This study examines the forensics of digital evidence on storage media with four test scenarios. Digital forensic processing uses forensic processes based on the National Institute of Standards and Technology (NIST) guidelines. This study produces an analysis in which evidence processed with scenarios 1 and 4 is valid digital evidence to be submitted to court, while evidence 2 and 3 is invalid evidence. The results of this digital evidence can be used for investigations under the ITE law.
Keywords: autopssy; digital forensics; storage media; FTK Imager.
Abstrak: Media Penyimpanan merupakan alat yang tak terpisahkan dari kehidupan sehari-hari. Dengan Media Penyimpanan, pengguna dapat menyimpan data penting, baik pribadi maupun tempat kerja. Selain itu, dalam banyak kasus, hukum Indonesia menggunakan Media Penyimpanan sebagai alat bukti. Undang-Undang Informasi dan Transaksi Elektronik (UU ITE) mengatur bagaimana penyediaan alat bukti digital menjadi alat bukti yang kuat di pengadilan. Penelitian ini mengkaji forensik terhadap alat bukti digital pada Media Penyimpanan dengan empat skenario pengujian. Pemrosesan forensik digital menggunakan proses forensik berdasarkan panduan National Institute of Standards and Technology (NIST). Penelitian ini menghasilkan analisis di mana alat bukti yang diproses dengan skenario 1 dan 4 merupakan alat bukti digital yang sah untuk diajukan ke pengadilan, sedangkan alat bukti 2 dan 3 merupakan alat bukti yang tidak sah. Hasil dari barang bukti digital ini, dapat digunakan untuk penyelidikan didalam undang-undang ITE.
Kata kunci: otopsi; forensik digital; media penyimpanan; FTK Imager
Abstract:Abstract: The growing intensity of cyber attacks, marked by rapid, large-scale, automated, and adaptive execution, requires analytical methods that represent the diversity of network environments, including variations in…
target platforms such as IoT, traditional networks, and hybrid infrastructures. This study compares machine learning models for cyber attack classification under heterogeneous environmental conditions and formulates a conceptual optimization framework based on model performance. Four publicly available benchmark datasets were used, namely UNB CIC IoT 2023, UNB CIC IDS-2018, UNSW-NB15, and a Kaggle cyber security attacks dataset, comprising approximately 40,000 to over 3.6 million records and 25 to 80 features across IoT, conventional, and mixed network environments. Random Forest, XGBoost, Multilayer Perceptron, and Transformer were implemented within a unified pipeline involving preprocessing, feature selection, and Bayesian Optimization-based hyperparameter tuning. All models achieved F1-score and Cohen's Kappa above 96%, with XGBoost performing best (97.80%, 97.26%), followed by Random Forest (97.78%, 96.96%) and Transformer (97.44%, 96.82%), while MLP scored lowest (96.74%, 96.00%), a gap below one percentage point. Confusion matrix analysis revealed persistent misclassification in minority and overlapping attack classes, informing a proposed adaptive cyber attack simulation optimization framework.
Keywords: cyber attacks; optimization; machine learning; environmental variability.
Abstrak: Meningkatnya intensitas serangan siber yang berlangsung cepat, masif, otomatis, dan adaptif menuntut pendekatan analitis yang merepresentasikan keragaman lingkungan jaringan, termasuk perbedaan karakteristik platform sasaran seperti Internet of Things (IoT), jaringan konvensional, dan infrastruktur hibrida. Penelitian ini membandingkan model machine learning untuk klasifikasi serangan siber pada kondisi lingkungan heterogen, sekaligus menyusun kerangka optimasi konseptual berdasarkan performa model. Empat dataset benchmark publik digunakan, yaitu UNB CIC IoT 2023, UNB CIC IDS-2018, UNSW-NB15, serta dataset Kaggle cyber security attacks, dengan jumlah data berkisar 40.000 hingga lebih dari 3,6 juta rekaman dan 25 sampai 80 fitur, mewakili lingkungan IoT, konvensional, dan campuran. Random Forest, XGBoost, Multilayer Perceptron, dan Transformer diimplementasikan melalui pipeline terpadu mencakup pra-pemrosesan, seleksi fitur, dan optimasi hyperparameter berbasis Bayesian Optimization. Seluruh model mencapai F1-score dan Cohen's Kappa di atas 96%, dengan XGBoost menunjukkan performa terbaik (97,80%, 97,26%), diikuti Random Forest (97,78%, 96,96%) dan Transformer (97,44%, 96,82%), sementara MLP mencatat skor terendah (96,74%, 96,00%), dengan selisih kurang dari satu poin persentase. Analisis confusion matrix mengungkap misklasifikasi yang konsisten pada kelas minoritas dan serangan dengan karakteristik serupa, yang menjadi dasar kerangka optimasi simulasi serangan siber adaptif yang diusulkan.
Kata kunci: serangan siber; optimasi; machine learning; variabilitas lingkungan
Abstract:Abstract: Stunting is a chronic nutritional condition in toddlers characterized by a Height-for-Age (HFA) measurement below the standard growth threshold, necessitating early detection to prevent long-term consequences.…
This study aims to classify toddler stunting status by comparing three machine learning methods: Random Forest (RF), K-Nearest Neighbor (KNN), and Support Vector Machine (SVM). The dataset comprises 345 toddler records from Puskesmas Indramayu (2025), including weight, height, and nutritional status based on WFA, HFA, and WFH indicators. Preprocessing steps include data cleaning, StandardScaler normalization, One-Hot Encoding for categorical features, and splitting the training and testing data with a ratio of 80:20. The comparison results are that KNN achieved the best performance with an accuracy of 71.01%, a precision of 0.69, a recall of 0.69, and an F1 score of 0.67, while RF and SVM both had an accuracy of 69.57% with F1 scores of 0.67 and 0.68, respectively. Thus, KNN demonstrated superior effectiveness in classifying the stunting status of toddlers compared to RF and SVM on this dataset.
Keywords: KNN; Random Forest; SVM; Stunting; toddlers
Abstract: Stunting adalah kondisi gizi kronis pada balita yang ditandai dengan pengukuran Tinggi Badan menurut Usia (HFA) di bawah ambang batas pertumbuhan standar, sehingga memerlukan deteksi dini untuk mencegah konsekuensi jangka panjang. Penelitian ini bertujuan untuk mengklasfikasikan status stunting pada balita dengan membandingkan tiga metode pembelajaran mesin: Random Forest (RF), K-Nearest Neighbor (KNN), dan Support Vector Machine (SVM). Kumpulan data terdiri dari 345 catatan balita dari puskesmas indramayu (2025), termaksut brat badan, tinggi badan, dan status gizi berdasarkan indicator WFA, HFA, dan WFH. Langkah-langkah prapemrosesan meliputi pembersian data, normalisasi Stand-ardScaler, One-Hot Encoding untuk fitur kategirikal, serta pembagian data pelatihan dan pengujian dengan rasio 80:20. Hasil perbadingan adalah KNN mencapai kinerja terbaik dengan akurasi 71,01%, presisi 0,69, recall 0,69, dan skor F1 sebesar 0,67, RF dan SVM keduanya memiliki akurasi 69,57% dengan skor F1 masing-masing sebesar 0,67 dan 0,68. Dengan demikian, KNN menunjukkan keefektifan yang lebih unggul dalam mengklasifikasikan status stunting balita dibandingkan dengan RF dan SVM pada da-taset ini.
Kata kunci: KNN; random forest; SVM; Stunting; Balita