Search Articles & Publications

Showing 119 articles found for "Features"

INTELLIGENT DIGITAL FORENSICS FILE MANIPULATION DETECTION USING METADATA ANALYSIS AND RANDOM FOREST

Panggabean, Erwin Gabe, Perwira, Yuda, Parulian Sinaga, Dedi Candro, Lidia Lubis , Nur, Suheru, Muhammad
Abstract: Abstract: The advancement of digital technology has made it easier to create, process, and distribute files—using 317 files from the dataset https://www.kaggle.com/datasets/axon data/selfie-and-official-id-photo-dataset-18k… t-18k images?select=metadata_image.csv has also introduced new challenges, such as the increasing practice of digital file manipulation that is difficult to detect visually. Therefore, an intelligent digital forensics system that can automatically and accurately detect file authenticity is required. This study aims to develop an intelligent digital forensics system for detecting file manipulation by leveraging metadata analysis and the Random Forest classification method. The methods used include extracting metadata from digital files—such as time information, device details, and processing history—followed by analysis to identify patterns of inconsistency that indicate manipulation. This data is then used as features in the classification process using the Random Forest algorithm to distinguish between original and manipulated files. The results of this study are expected to show that the use of metadata analysis combined with the Random Forest algorithm can improve accuracy in detecting digital file manipulation compared to conventional methods. The resulting system is expected to provide an effective, efficient, and integrated solution to support digital forensic investigations, Based on the test results, the system demonstrated good performance with an accuracy rate of 94%.   Keywords: Digital Forensics;File Manipulation;Metadata Analysis;Random Forest;Classification;Machine Learning   Abstrak:Perkembangan teknologi digital telah meningkatkan kemudahan dalam pembuatan, pengolahan,dan distribusi file sebanyak 317 file, sumber datasets https:// www.kaggle.com/datasets/axondata/selfie-and-official-id-photo-dataset-18k-images?select =metadata_image.csv, namun juga menimbulkan tantangan baru berupa meningkatnya praktik manipulasi file digital yang sulit dideteksi secara kasat mata. Oleh karena itu, diperlukan suatu sistem forensik digital yang cerdas dan mampu mendeteksi keaslian file secara otomatis dan akurat. Penelitian ini bertujuan untuk mengembangkan sistem forensik digital cerdas untuk deteksi manipulasi file dengan memanfaatkan analisis metadata dan metode klasifikasi Random Forest. Metode yang digunakan meliputi proses ekstraksi metadata dari file digital, seperti informasi waktu, perangkat, dan riwayat pengolahan, kemudian dilakukan analisis untuk menemukan pola ketidaksesuaian yang mengindikasikan adanya manipulasi. Selanjutnya, data tersebut digunakan sebagai fitur dalam proses klasifikasi menggunakan algoritma Random Forest untuk membedakan antara file asli dan file yang telah dimanipulasi. Hasil dari penelitian ini diharapkan menunjukkan bahwa penggunaan analisis metadata yang dikombinasikan dengan algoritma Random Forest mampu meningkatkan akurasi dalam mendeteksi manipulasi file digital dibandingkan metode konvensional. Sistem yang dihasilkan dapat memberikan solusi yang efektif, efisien, dan terintegrasi dalam mendukung proses investigasi forensik digital, Berdasarkan hasil pengujian, sistem menunjukkan performa yang baik dengan tingkat akurasi sebesar 94%.   Kata Kunci: Forensik Digital, Manipulasi File, Metadata, Random Forest, Klasifikasi, Machine Learning.

DEVELOPMENT OF A DIGITAL E-CRM AS A SOLUTION FOR CUSTOMER RELATIONSHIP MANAGEMENT AND TRANSACTION ACTIVITIES AT TOKO ZUMA

Nurul Azzuma, Afdhal Syafnur, Rahayu, Elly
Abstract: Abstract: Toko Zuma faces challenges in optimizing customer relationship management and transaction recording due to conventional manual systems, which hinder real-time loyalty monitoring and sales analysis. This research… h aims to design a digital Electronic Customer Relationship Management (E-CRM) system as an integrative solution for systematic and centralized management. The design method employs Unified Modeling Language (UML) for requirements analysis, user interface design, and Black-box Testing for validation. Results demonstrate a 100% success rate across all primary modules. The platform features Point Reward, automated transaction management, and live chat for direct interaction. Implementation enables personalized promotional strategies based on accurate data to increase customer retention. In conclusion, the Digital E-CRM system effectively automates business processes, serving as a strategic instrument for transparent and measurable customer relationship management. Keywords: digital e-crm; relationship management; toko zuma; transaction activities.     Abstrak: Toko Zuma menghadapi kendala dalam optimalisasi manajemen hubungan pelanggan dan pencatatan transaksi karena masih menggunakan sistem manual konvensional. Penelitian ini bertujuan merancang sistem Electronic Customer Relationship Management (E-CRM) digital sebagai solusi integratif untuk pengelolaan basis data dan transaksi secara terpusat. Metode perancangan meliputi analisis kebutuhan menggunakan Unified Modeling Language (UML), desain antarmuka, dan validasi fungsional melalui Black-box Testing. Hasil pengujian menunjukkan tingkat keberhasilan 100% pada seluruh modul utama. Platform ini dilengkapi fitur Point Reward, manajemen transaksi otomatis, dan media interaksi live chat. Implementasi sistem ini memungkinkan strategi promosi personal berdasarkan data akurat untuk meningkatkan retensi pelanggan. Simpulannya, sistem E-CRM digital berhasil mengotomatisasi proses bisnis dan menjadi instrumen strategis dalam manajemen hubungan pelanggan yang transparan dan terukur. Kata kunci: aktivitas transaksi; digital e-crm; pengelolaan relasi; toko zuma.

MULTI VIEW FEATURE FUSION FOR INDUSTRIAL ANOMALY DETECTION USING 1D-CNN

Nainggolan, Daniel Fernando, Hiskiawan, Puguh
Abstract: Abstract: Anomalous sound detection is essential for industrial predictive maintenance, as machine failures often originate from subtle acoustic changes during operation. However, high background noise and limitations of… conventional Convolutional Neural Networks (CNN) reduce detection reliability. This study proposes a 1D-CNN-based anomaly detection framework with multi-view feature fusion and temporal segmentation to enhance detection performance. The approach combines MFCC, Log-Mel Spectrogram, and Chroma STFT features, while temporal segmentation divides audio signals into 5-second segments to better capture transient anomalies. Experiments on the MIMII dataset under varying Signal-to-Noise Ratio (SNR) conditions show that MFCC and Log-Mel fusion achieves the best performance, with 97.90% accuracy and ROC-AUC of 0.9789. The model maintains accuracy above 90% at −6 dB, demonstrating strong robustness in noisy industrial environments. Keywords: industrial anomaly detection; 1D-CNN; multi-view feature fusion; temporal segmentation; MIMII dataset.   Abstrak: Deteksi anomali suara merupakan komponen penting dalam sistem pemeliharaan prediktif industri, karena kegagalan mesin sering diawali oleh perubahan akustik yang bersifat halus selama proses operasi. Namun, tingkat kebisingan yang tinggi serta keterbatasan arsitektur Convolutional Neural Network (CNN) konvensional dapat menurunkan keandalan deteksi. Penelitian ini bertujuan mengusulkan kerangka deteksi anomali berbasis 1D-CNN yang mengintegrasikan strategi fusi fitur multi-view dan segmentasi temporal untuk meningkatkan kinerja deteksi. Pendekatan yang digunakan menggabungkan fitur MFCC, Log-Mel Spectrogram dan Chroma STFT, sementara teknik temporal splitting membagi sinyal audio menjadi segmen berdurasi 5 detik untuk menangkap anomali yang bersifat sementara. Eksperimen menggunakan dataset MIMII pada berbagai kondisi Signal-to-Noise Ratio (SNR) menunjukkan bahwa kombinasi MFCC dan Log-Mel Spectrogram menghasilkan kinerja terbaik dengan akurasi 97,90% dan ROC-AUC sebesar 0,9789. Model juga mempertahankan akurasi di atas 90% pada kondisi kebisingan ekstrem (−6 dB) yang menunjukkan ketahanan yang baik dalam lingkungan industri yang bising. Kata kunci: deteksi anomali industri; 1D-CNN; fusi fitur multi-view; segmentasi temporal; dataset MIMII

IOT BASED HYDROPONIC WATER QUALITY CONTROL INTEGRATED WITH WEBSITE AND EARLY WARNING

Herman Saputra, Nofriadi, Nofriadi
Abstract: Abstract: The development of information and communication technology has driven digital transformation in various sectors, including agriculture. One of the technologies widely applied is the Internet of Things (IoT), which… hich enables devices to be interconnected through the internet to perform monitoring and data exchange in real time. In hydroponic cultivation, water quality stability is a crucial factor that affects plant growth. The main parameters that need to be monitored include water acidity level (pH), water temperature, and dissolved nutrient concentration measured using Total Dissolved Solids (TDS). However, water quality monitoring is still commonly conducted manually, making it less efficient and potentially causing delays in detecting changes in water conditions. This study aims to design an IoT-based water quality monitoring system for hydroponic cultivation using an ESP32 microcontroller integrated with pH, temperature, and TDS sensors. The collected data are sent to a server and displayed on a web dashboard in real time, equipped with automatic notification features. The proposed system is expected to improve monitoring efficiency and increase the productivity of hydroponic cultivation       Keywords: esp32; hydroponics; internet of things; real-time monitoring; water quality.   Abstrak: Perkembangan teknologi informasi dan komunikasi mendorong transformasi digital dalam berbagai sektor, termasuk pertanian. Salah satu teknologi yang banyak diterapkan adalah Internet of Things (IoT) yang memungkinkan perangkat saling terhubung melalui jaringan internet untuk melakukan pemantauan dan pertukaran data secara real-time. Pada budidaya hidroponik, kestabilan kualitas air menjadi faktor penting yang mempengaruhi pertumbuhan tanaman. Parameter utama yang perlu diperhatikan meliputi tingkat keasaman air (pH), suhu air, serta konsentrasi nutrisi terlarut yang diukur menggunakan Total Dissolved Solids (TDS). Namun, pemantauan kualitas air masih banyak dilakukan secara manual sehingga kurang efisien dan berpotensi menimbulkan keterlambatan dalam mendeteksi perubahan kondisi air. Penelitian ini bertujuan merancang sistem pemantauan kualitas air hidroponik berbasis IoT menggunakan mikrokontroler ESP32 yang terintegrasi dengan sensor pH, suhu, dan TDS. Data dikirim ke server dan ditampilkan pada web dashboard secara real-time serta dilengkapi notifikasi otomatis. Sistem ini diharapkan meningkatkan efisiensi pemantauan dan produktivitas budidaya hidroponik. Kata kunci: esp32; hidroponik; internet of things; kualitas air; monitoring real-time

STUDENT DEPRESSION SCREENING BASED ON THE OPTIMUM DATA BALANCING AND RANDOM FOREST

Adnan, M. Sayyidul, Budi Santoso, Irwan, Crysdian , Cahyo
Abstract: Abstract: Mental health issues, particularly depression among young adult university students, are often detected late due to stigma and reluctance to seek medical consultation. The objective of this study is to develop… an early screening model employing machine learning techniques, specifically the random forest algorithm, on a dataset of 268 students (aged 17-29 years; consisting of 98 males and 170 females) within a multicultural educational setting. The principal challenges associated with this dataset are class imbalance and the potential for data leakage from clinical scores. This study implements a rigorous feature selection approach that involves the elimination of depression score features and the utilization of the Synthetic Minority Over-sampling Technique (SMOTE) to balance the training data distribution. Furthermore, a Threshold Tuning strategy is employed to prioritize detection sensitivity (Recall). The findings indicate that reducing the decision threshold to an optimal value of 0.25 led to a substantial enhancement in the recall value, increasing it from 36% (baseline) to 77%. A feature importance analysis was conducted, the results of which indicated that Total Social Connectedness (ToSC) is the most dominant predictor. In summary, the present study corroborates the notion that optimizing sensitivity through threshold tuning is of paramount importance for medical screening. Furthermore, social isolation factors emerge as more significant indicators of depression risk than demographic attributes.             Keywords: data mining; depression; imbalanced data; random forest; smote; threshold tuning     Abstrak: Masalah kesehatan mental, khususnya depresi di kalangan mahasiswa dewasa muda, sering terdeteksi terlambat akibat stigma dan enggan mencari konsultasi medis. Tujuan studi ini adalah mengembangkan model skrining dini menggunakan teknik machine learning, khususnya algoritma random forest, pada dataset 268 mahasiswa (usia 17-29 tahun; terdiri dari 98 laki-laki dan 170 perempuan) dalam lingkungan pendidikan multikultural. Tantangan utama yang terkait dengan dataset ini adalah ketidakseimbangan kelas dan potensi kebocoran data dari skor klinis. Studi ini menerapkan pendekatan seleksi fitur yang ketat, yang melibatkan eliminasi fitur skor depresi dan penggunaan Teknik Over-sampling Minoritas Sintetis (SMOTE) untuk menyeimbangkan distribusi data pelatihan. Selain itu, strategi Penyesuaian Ambang Batas diterapkan untuk memprioritaskan sensitivitas deteksi (Recall). Hasil penelitian menunjukkan bahwa mengurangi ambang batas keputusan ke nilai optimal 0,25 menyebabkan peningkatan signifikan dalam nilai recall, dari 36% (dasar) menjadi 77%. Analisis pentingnya fitur dilakukan, hasilnya menunjukkan bahwa Total Social Connectedness (ToSC) adalah prediktor yang paling dominan. Secara ringkas, studi ini membenarkan bahwa mengoptimalkan sensitivitas melalui penyesuaian ambang batas sangat penting untuk skrining medis. Selain itu, faktor isolasi sosial muncul sebagai indikator risiko depresi yang lebih signifikan daripada atribut demografis.   Kata kunci: penambangan data; depresi; data tidak seimbang; hutan acak; smote; penyesuaian ambang batas

PREDICTING TEA HARVEST PRODUCTION AT BAH BUTONG USING RANDOM FOREST AND HISTORICAL DATA

Prayoga, Hafizd, Ramadhan Nasution, Yusuf
Abstract: Abstract: Accurate forecasts of tea harvest production are important for workforce planning, factory operations, and marketing decisions, yet conventional estimation in plantations often relies on field experience and can… n be biased and less adaptive to changing conditions. This study aims to develop a Random Forest Regression model to predict tea harvest production at the Bah Butong tea plantation using historical operational and climate-related data. The dataset consists of 60 monthly records (2020–2024) with six predictor variables: rainfall (mm), number of rainy days, pest level, weed level, number of harvested trees and land area. Data were split into 80% training (48 samples) and 20% testing (12 samples). Model hyperparameters were optimized using RandomizedSearchCV with RepeatedKFold cross-validation (5 folds, 3 repeats). The tuned model achieved MSE of 668,980,524.45, RMSE of 25,864.66 kg, MAE of 19,838.69 kg, and MAPE of 7.59% on the test set. The results indicate that the model can provide practical production estimates, with errors averaging about 7–8% of the actual production. Feature importance analysis shows that the number of harvested tea bushes and cultivated area contribute most to predictions. Future work should extend the historical period and incorporate time-based features (seasonality/lag) for improved forecasting.             Keywords: hyperparameter tuning; production prediction; random forest; regression; tea harvest   Abstrak: Perkiraan akurat produksi panen teh sangat penting untuk perencanaan tenaga kerja, operasional pabrik, dan keputusan pemasaran, namun estimasi konvensional di perkebunan seringkali bergantung pada pengalaman lapangan dan dapat bias serta kurang adaptif terhadap perubahan kondisi. Studi ini bertujuan untuk mengembangkan model Regresi Random Forest untuk memprediksi produksi panen teh di perkebunan teh Bah Butong menggunakan data operasional dan data terkait iklim historis. Dataset terdiri dari 60 catatan bulanan (2020–2024) dengan enam variabel prediktor: curah hujan (mm), jumlah hari hujan, tingkat hama, tingkat gulma, jumlah pokok panen, dan luas lahan. Data dibagi menjadi 80% data pelatihan (48 sampel) dan 20% data pengujian (12 sampel). Parameter model dioptimalkan menggunakan RandomizedSearchCV dengan validasi silang RepeatedKFold (5 lipatan, 3 pengulangan). Model yang telah disempurnakan mencapai MSE sebesar 668.980.524,45, RMSE sebesar 25.864,66 kg, MAE sebesar 19.838,69 kg, dan MAPE sebesar 7,59% pada set data uji. Hasil tersebut menunjukkan bahwa model dapat memberikan estimasi produksi yang praktis, dengan kesalahan rata-rata sekitar 7–8% dari produksi aktual. Analisis kepentingan fitur menunjukkan bahwa jumlah semak teh yang dipanen dan luas lahan budidaya paling berkontribusi pada prediksi. Pekerjaan selanjutnya harus memperpanjang periode historis dan menggabungkan fitur berbasis waktu (musiman/lag) untuk peramalan yang lebih baik.   Kata kunci: panen teh; prediksi produksi; random forest; regresi; tuning parameter

E-CRM MYSAFFANA FOR OPTIMIZING CUSTOMER AND TRANSACTION DATA AT SAFFANA BOUTIQUE

Masytha Siagian, Nurul, Dwi Sena, Maulana, Madonna Yuma, Febby
Abstract: Abstract: The development of information technology encourages retail businesses to manage customer and transaction data more effectively. However, many small-scale retailers still rely on manual record-keeping, resulting… g in unintegrated data and limited decision-making support. This study aims to design and implement a web-based Electronic Customer Relationship Management (E-CRM) system called MySaffana for Saffana Gallery Boutique to optimize customer and transaction data management. The research method includes requirement analysis, system design using UML, implementation using PHP and MySQL, and system testing using black box testing. The results show that the MySaffana system is able to manage customer data, products, transactions, and sales reports in an integrated and efficient manner. System testing indicates that all main features function properly and meet user requirements. Therefore, the developed E-CRM system provides an effective and practical solution for strengthening data-driven decision-making in small-scale retail businesses. Keywords: boutique; customer data management; customer profiling; E-CRM.    Abstrak: Perkembangan teknologi informasi mendorong usaha ritel untuk mengelola data pelanggan dan transaksi secara lebih efektif. Namun, banyak usaha ritel skala kecil masih melakukan pencatatan secara manual sehingga data tidak terintegrasi dan kurang optimal dalam mendukung keputusan. Penelitian ini bertujuan untuk merancang dan mengimplementasikan sistem Electronic Customer Relationship Management (E-CRM) berbasis web bernama MySaffana pada Butik Saffana Gallery yang dapat mengoptimalkan pengelolaan data pelanggan dan transaksi. Metode penelitian meliputi analisis kebutuhan, perancangan sistem menggunakan UML, implementasi dengan PHP dan MySQL, serta pengujian menggunakan metode black box testing. Hasil penelitian menunjukkan bahwa sistem MySaffana mampu mengelola data pelanggan, produk, transaksi, dan laporan penjualan secara terintegrasi dan efisien. Pengujian sistem membuktikan seluruh fitur berjalan sesuai fungsi dan kebutuhan pengguna. Dengan demikian, sistem E-CRM berbasis web ini dapat menjadi solusi yang efektif dalam mendukung pengelolaan data dan pengambilan keputusan berbasis data bagi usaha ritel skala kecil. Kata kunci: butik; E-CRM; profil pelanggan; pengelolaan data pelanggan.

OPTIMIZING CYBER ATTACK SIMULATION AS A RESPONSE TO ESCALATING SECURITY THREATS USING A MACHINE LEARNING APPROACH

Lubis, Rivaldi, Halim, Apriyanto, Tanjaya, Felix Jansen, Tandri
Abstract: Abstract: The growing intensity of cyber attacks, marked by rapid, large-scale, automated, and adaptive execution, requires analytical methods that represent the diversity of network environments, including variations in… target platforms such as IoT, traditional networks, and hybrid infrastructures. This study compares machine learning models for cyber attack classification under heterogeneous environmental conditions and formulates a conceptual optimization framework based on model performance. Four publicly available benchmark datasets were used, namely UNB CIC IoT 2023, UNB CIC IDS-2018, UNSW-NB15, and a Kaggle cyber security attacks dataset, comprising approximately 40,000 to over 3.6 million records and 25 to 80 features across IoT, conventional, and mixed network environments. Random Forest, XGBoost, Multilayer Perceptron, and Transformer were implemented within a unified pipeline involving preprocessing, feature selection, and Bayesian Optimization-based hyperparameter tuning. All models achieved F1-score and Cohen's Kappa above 96%, with XGBoost performing best (97.80%, 97.26%), followed by Random Forest (97.78%, 96.96%) and Transformer (97.44%, 96.82%), while MLP scored lowest (96.74%, 96.00%), a gap below one percentage point. Confusion matrix analysis revealed persistent misclassification in minority and overlapping attack classes, informing a proposed adaptive cyber attack simulation optimization framework.             Keywords: cyber attacks; optimization; machine learning; environmental variability.     Abstrak: Meningkatnya intensitas serangan siber yang berlangsung cepat, masif, otomatis, dan adaptif menuntut pendekatan analitis yang merepresentasikan keragaman lingkungan jaringan, termasuk perbedaan karakteristik platform sasaran seperti Internet of Things (IoT), jaringan konvensional, dan infrastruktur hibrida. Penelitian ini membandingkan model machine learning untuk klasifikasi serangan siber pada kondisi lingkungan heterogen, sekaligus menyusun kerangka optimasi konseptual berdasarkan performa model. Empat dataset benchmark publik digunakan, yaitu UNB CIC IoT 2023, UNB CIC IDS-2018, UNSW-NB15, serta dataset Kaggle cyber security attacks, dengan jumlah data berkisar 40.000 hingga lebih dari 3,6 juta rekaman dan 25 sampai 80 fitur, mewakili lingkungan IoT, konvensional, dan campuran. Random Forest, XGBoost, Multilayer Perceptron, dan Transformer diimplementasikan melalui pipeline terpadu mencakup pra-pemrosesan, seleksi fitur, dan optimasi hyperparameter berbasis Bayesian Optimization. Seluruh model mencapai F1-score dan Cohen's Kappa di atas 96%, dengan XGBoost menunjukkan performa terbaik (97,80%, 97,26%), diikuti Random Forest (97,78%, 96,96%) dan Transformer (97,44%, 96,82%), sementara MLP mencatat skor terendah (96,74%, 96,00%), dengan selisih kurang dari satu poin persentase. Analisis confusion matrix mengungkap misklasifikasi yang konsisten pada kelas minoritas dan serangan dengan karakteristik serupa, yang menjadi dasar kerangka optimasi simulasi serangan siber adaptif yang diusulkan.   Kata kunci: serangan siber; optimasi; machine learning; variabilitas lingkungan

ANALYSIS OF THE EFFECT OF E-CRM AUTOMATION ON SERVICE EFFICIENCY AT DIAH FASHION STORE

Dinda Elpita Sari Munthe, Fauriatun Helmiah, Chitra Latiffani
Abstract: Abstract: The rapid development of digital technology has brought significant changes in consumption patterns and customer behavior, particularly in the fashion retail sector. Increasing competition and rising cynsumer expectations… xpectations for fast, accurate, and technology-based services require businesses to innovate and undergo digital transformation. One widely used approach is the implementation of automation-based Electronic Customer Relationship Management (E-CRM). This study aims to analyze the implementation of E-CRM automation and its impact on service efficiency at Toko Diah Fashion, a fashion retail business that still faces service challenges due to manual systems, such as customer data duplication, delayed responses, and difficulty in monitoring transaction history. The research method used is a descriptive qualitative method with data collection techniques through observation, interviews, and documentation. The research focus is limited to aspects of service efficiency, including service speed, accuracy in managing customer data, and ease in customer follow-up. The E-CRM automation system studied is designed using PHP programming language and a MySQL database. The research results indicate that the implementation of E-CRM automation can significantly improve service efficiency. This system facilitates integrated customer data management, speeds up the service process, and supports more personalized communication through notification features and transaction history recording. Keyword: automation; e-crm; fashion retail; service efficiency.   Abstrak: Perkembangan teknologi digital yang semakin pesat telah membawa perubahan signifikan dalam pola konsumsi dan perilaku pelanggan, khususnya dalam sektor ritel fashion. Persaingan yang semakin ketat serta meningkatnya ekspektasi konsumen terhadap layanan yang cepat, akurat dan berbasis teknologi menuntut pelaku usaha untuk melakukan inovasi dan transformasi digital. Salah satu pendekatan yang banyak digunakan adalah penerapan Electronic Customer Relationship Management (E-CRM) berbasis automasi. Penelitian ini bertujuan untuk menganalisis penerapan automasi E-CRM serta pengaruhnya terhadap efisiensi pelayanan pada Toko Diah Fashion, sebuah usaha ritel fashion yang masih menghadapi kendala pelayanan akibat sistem manual, seperti duplikasi data pelanggan, keterlambatan respons, dan kesulitan dalam pemantauan histori transaksi. Metode penelitian yang digunakan adalah metode kualitatif deskriptif dengan teknik pengumpulan data melalui observasi, wawancara, dan dokumentasi. Fokus penelitian dibatasi pada aspek efisiensi pelayanan, meliputi kecepatan pelayanan, ketepatan pengelolaan data pelanggan, serta kemudahan dalam tindak lanjut pelanggan. Sistem automasi E-CRM yang dikaji dirancang menggunakan bahasa pemrograman PHP dan basis data MySQL. Hasil penelitian menunjukkan bahwa penerapan automasi E-CRM mampu meningkatkan efisiensi pelayanan secara signifikan. Sistem ini mempermudah pengelolaan data pelanggan secara terintegrasi, mempercepat proses pelayanan, serta mendukung komunikasi yang lebih personal melalui fitur notifikasi dan pencatatan histori transaksi.  Kata kunci: automasi; e-crm; efisiensi pelayanan; ritel fashion.

COMPARATIVE ANALYSIS OF RANDOM FOREST, KNN, AND SVM FOR TODDLER STUNTING CLASSIFICATION

Shula, Maritza Ayu, Sri Siswanti
Abstract: Abstract: Stunting is a chronic nutritional condition in toddlers characterized by a Height-for-Age (HFA) measurement below the standard growth threshold, necessitating early detection to prevent long-term consequences.… This study aims to classify toddler stunting status by comparing three machine learning methods: Random Forest (RF), K-Nearest Neighbor (KNN), and Support Vector Machine (SVM). The dataset comprises 345 toddler records from Puskesmas Indramayu (2025), including weight, height, and nutritional status based on WFA, HFA, and WFH indicators. Preprocessing steps include data cleaning, StandardScaler normalization, One-Hot Encoding for categorical features, and splitting the training and testing data with a ratio of 80:20. The comparison results are that KNN achieved the best performance with an accuracy of 71.01%, a precision of 0.69, a recall of 0.69, and an F1 score of 0.67, while RF and SVM both had an accuracy of 69.57% with F1 scores of 0.67 and 0.68, respectively. Thus, KNN demonstrated superior effectiveness in classifying the stunting status of toddlers compared to RF and SVM on this dataset.             Keywords: KNN; Random Forest; SVM; Stunting; toddlers     Abstract: Stunting adalah kondisi gizi kronis pada balita yang ditandai dengan pengukuran Tinggi Badan menurut Usia (HFA) di bawah ambang batas pertumbuhan standar, sehingga memerlukan deteksi dini untuk mencegah konsekuensi jangka panjang. Penelitian ini bertujuan untuk mengklasfikasikan status stunting pada balita dengan membandingkan tiga metode pembelajaran mesin: Random Forest (RF), K-Nearest Neighbor (KNN), dan Support Vector Machine (SVM). Kumpulan data terdiri dari 345 catatan balita dari puskesmas indramayu (2025), termaksut brat badan, tinggi badan, dan status gizi berdasarkan indicator WFA, HFA, dan WFH. Langkah-langkah prapemrosesan meliputi pembersian data, normalisasi Stand-ardScaler, One-Hot Encoding untuk fitur kategirikal, serta pembagian data pelatihan dan pengujian dengan rasio 80:20. Hasil perbadingan adalah KNN mencapai kinerja terbaik dengan akurasi 71,01%, presisi 0,69, recall 0,69, dan skor F1 sebesar 0,67,  RF dan SVM  keduanya memiliki akurasi 69,57% dengan skor F1 masing-masing sebesar 0,67 dan 0,68. Dengan demikian, KNN menunjukkan keefektifan yang lebih unggul dalam mengklasifikasikan status stunting balita dibandingkan dengan RF dan SVM pada da-taset ini.   Kata kunci: KNN; random forest; SVM; Stunting; Balita