Abstract:Abstract: Rehabilitation programs are essential in correctional systems to equip inmates with the skills and behavioral readiness required for social reintegration. However, rehabilitation program assignment in many correctional…
ectional institutions remains dependent on manual and subjective assessments, which may result in inconsistent decisions. This study develops a Random Forest–based prediction system to support objective and data-driven rehabilitation program determination. A quantitative approach was applied using historical inmate data from January 2023 to January 2025, comprising 2,023 records. The research process included data preprocessing, an 80:20 training–testing split, model training, and performance evaluation using accuracy, precision, recall, and F1-score metrics. The results show that the model achieved an accuracy of 86.17% during training in Google Colab and 68.83% when deployed within the application system. This performance gap reflects real-world deployment and computational constraints rather than model failure. The proposed system provides consistent and objective rehabilitation program recommendations, thereby supporting more effective rehabilitation planning and decision-making in correctional institutions.
Keywords: correctional institutions; inmate rehabilitation programs; machine learning; random Forest; prediction system
Abstrak: Program pembinaan narapidana memiliki peran penting dalam sistem pemasyarakatan untuk membekali warga binaan dengan keterampilan serta kesiapan perilaku dalam proses reintegrasi ke masyarakat. Namun, pada banyak lembaga pemasyarakatan, penentuan program pembinaan masih bergantung pada penilaian manual yang bersifat subjektif, sehingga berpotensi menimbulkan ketidakkonsistenan dalam pengambilan keputusan. Penelitian ini mengembangkan sistem prediksi program pembinaan narapidana berbasis algoritma Random Forest guna mendukung pengambilan keputusan yang objektif dan berbasis data. Pendekatan kuantitatif diterapkan menggunakan data historis narapidana periode Januari 2023 hingga Januari 2025 sebanyak 2.023 data. Tahapan penelitian meliputi prapemrosesan data, pembagian data latih dan uji dengan rasio 80:20, pelatihan model, serta evaluasi performa menggunakan metrik akurasi, precision, recall, dan F1-score. Hasil penelitian menunjukkan bahwa model mencapai akurasi sebesar 86,17% pada tahap pelatihan di Google Colab dan 68,83% saat diimplementasikan pada sistem aplikasi. Perbedaan performa tersebut mencerminkan keterbatasan lingkungan operasional, bukan kegagalan model. Secara keseluruhan, sistem yang dikembangkan mampu memberikan rekomendasi program pembinaan yang lebih objektif dan konsisten, sehingga mendukung perencanaan pembinaan yang lebih efektif.
Kata kunci: mesin pembelajaran; program pembinaan narapidana; random Forest; sistem pemasyarakatan; sistem prediksi
Abstract:Abstract: The rapid growth of e-commerce in Indonesia has increased consumer interactions with digital platforms, particularly Lazada, Tokopedia, and Blibli, resulting in a large volume of customer reviews that reflect consumer…
onsumer experiences and perceptions but have not been optimally utilized in business decision-making. The main issue addressed in this study is how to process customer review data to generate meaningful information regarding consumer opinions. This research aims to apply web scraping techniques to collect customer review data and conduct sentiment analysis to identify trends in consumer opinions across the three e-commerce platforms. The dataset consists of 3,000 customer reviews, with 1,000 reviews collected from each platform, covering aspects such as shopping experience, service quality, delivery process, and customer satisfaction. The research methodology includes data collection through web scraping, text preprocessing for data cleaning and normalization, sentiment analysis using machine learning approaches, and visualization of sentiment results. The findings indicate differences in the distribution of positive, negative, and neutral sentiments across platforms, reflecting variations in consumer experiences and service strategies. These results demonstrate that sentiment analysis based on customer reviews can serve as strategic input to improve service quality, business performance, and marketing strategies in Indonesia’s e-commerce sector.
Keywords: customer reviews; digital services; e-commerce; sentiment analysis; web scarping
Abstrak: Pertumbuhan pesat e-commerce di Indonesia meningkatkan interaksi konsumen dengan platform digital, khususnya Lazada, Tokopedia, dan Blibli, yang menghasilkan ulasan pelanggan dalam jumlah besar sebagai cerminan pengalaman dan persepsi konsumen, namun belum dimanfaatkan secara optimal dalam pengambilan keputusan bisnis. Permasalahan utama penelitian ini adalah bagaimana mengolah data ulasan tersebut agar dapat memberikan informasi yang bermakna mengenai opini konsumen. Penelitian ini bertujuan menerapkan web scraping untuk mengumpulkan data ulasan pelanggan serta melakukan analisis sentimen guna mengidentifikasi tren opini konsumen pada ketiga platform e-commerce tersebut. Data yang digunakan berjumlah 3.000 ulasan pelanggan, dengan masing-masing platform diwakili oleh 1.000 ulasan yang mencakup pengalaman berbelanja, kualitas layanan, proses pengiriman, dan tingkat kepuasan pelanggan. Metode penelitian meliputi pengambilan data menggunakan web scraping, pra-pemrosesan teks untuk pembersihan dan normalisasi data, analisis sentimen dengan pendekatan pembelajaran mesin, serta visualisasi hasil sentimen. Hasil penelitian menunjukkan adanya perbedaan distribusi sentimen positif, negatif, dan netral pada setiap platform, yang mencerminkan variasi pengalaman konsumen dan strategi layanan. Temuan ini menunjukkan bahwa analisis sentimen berbasis ulasan pelanggan dapat menjadi masukan strategis untuk meningkatkan kualitas layanan, kinerja bisnis, dan strategi pemasaran e-commerce di Indonesia.
Kata kunci: customer reviews; digital services;e-commerce;sentiment analysis;web scarping
Abstract:Abstract: Stunting is a chronic nutritional condition in toddlers characterized by a Height-for-Age (HFA) measurement below the standard growth threshold, necessitating early detection to prevent long-term consequences.…
This study aims to classify toddler stunting status by comparing three machine learning methods: Random Forest (RF), K-Nearest Neighbor (KNN), and Support Vector Machine (SVM). The dataset comprises 345 toddler records from Puskesmas Indramayu (2025), including weight, height, and nutritional status based on WFA, HFA, and WFH indicators. Preprocessing steps include data cleaning, StandardScaler normalization, One-Hot Encoding for categorical features, and splitting the training and testing data with a ratio of 80:20. The comparison results are that KNN achieved the best performance with an accuracy of 71.01%, a precision of 0.69, a recall of 0.69, and an F1 score of 0.67, while RF and SVM both had an accuracy of 69.57% with F1 scores of 0.67 and 0.68, respectively. Thus, KNN demonstrated superior effectiveness in classifying the stunting status of toddlers compared to RF and SVM on this dataset.
Keywords: KNN; Random Forest; SVM; Stunting; toddlers
Abstract: Stunting adalah kondisi gizi kronis pada balita yang ditandai dengan pengukuran Tinggi Badan menurut Usia (HFA) di bawah ambang batas pertumbuhan standar, sehingga memerlukan deteksi dini untuk mencegah konsekuensi jangka panjang. Penelitian ini bertujuan untuk mengklasfikasikan status stunting pada balita dengan membandingkan tiga metode pembelajaran mesin: Random Forest (RF), K-Nearest Neighbor (KNN), dan Support Vector Machine (SVM). Kumpulan data terdiri dari 345 catatan balita dari puskesmas indramayu (2025), termaksut brat badan, tinggi badan, dan status gizi berdasarkan indicator WFA, HFA, dan WFH. Langkah-langkah prapemrosesan meliputi pembersian data, normalisasi Stand-ardScaler, One-Hot Encoding untuk fitur kategirikal, serta pembagian data pelatihan dan pengujian dengan rasio 80:20. Hasil perbadingan adalah KNN mencapai kinerja terbaik dengan akurasi 71,01%, presisi 0,69, recall 0,69, dan skor F1 sebesar 0,67, RF dan SVM keduanya memiliki akurasi 69,57% dengan skor F1 masing-masing sebesar 0,67 dan 0,68. Dengan demikian, KNN menunjukkan keefektifan yang lebih unggul dalam mengklasifikasikan status stunting balita dibandingkan dengan RF dan SVM pada da-taset ini.
Kata kunci: KNN; random forest; SVM; Stunting; Balita
Abstract:Abstract: The rapid degradation of mangrove ecosystems threatens coastal biodiversity, shoreline stability, and carbon sequestration capacity, particularly in areas experiencing intense human activity. However, community-based…
-based participatory mangrove monitoring remains limited due to the lack of accessible and user-friendly digital tools. This study aims to design an intuitive mobile application for mangrove tree detection and participatory ecological monitoring using a User-Centered Design (UCD) approach. The research was conducted iteratively through user needs analysis, prototype development, and usability evaluation involving local governments, conservation practitioners, and non-expert users. The proposed application integrates machine learning for automated mangrove recognition with geospatial visualization and real-time feedback to support field-based monitoring. Usability evaluation using the System Usability Scale (SUS) yielded an overall score of 82.3, categorized as excellent usability, indicating high user satisfaction and intuitive interaction. The results demonstrate that integrating UCD and machine learning enhances usability, user engagement, and the accuracy of mangrove documentation under real field conditions. Overall, this study presents a field-ready, user-centered mobile solution that bridges usability engineering and participatory mangrove monitoring as a replicable model for inclusive ecological application development.
Keywords: Carbon sequestration; mangrove monitoring; mobile application; user-centered design; usability evaluation
Abstrak: Degradasi ekosistem mangrove yang semakin cepat mengancam keanekaragaman hayati pesisir, stabilitas garis pantai, dan kapasitas sekuestrasi karbon, terutama di wilayah dengan aktivitas manusia yang intens. Namun, pemantauan mangrove secara partisipatif berbasis komunitas masih terbatas akibat kurangnya perangkat digital yang mudah diakses dan ramah pengguna. Penelitian ini bertujuan merancang aplikasi mobile yang intuitif untuk deteksi pohon mangrove dan pemantauan ekologi partisipatif dengan menggunakan pendekatan User-Centered Design (UCD). Penelitian dilakukan secara iteratif melalui analisis kebutuhan pengguna, pengembangan prototipe, dan evaluasi kegunaan dengan melibatkan pemerintah daerah, praktisi konservasi, serta pengguna non-ahli. Aplikasi yang diusulkan mengintegrasikan pembelajaran mesin untuk pengenalan mangrove secara otomatis dengan visualisasi geospasial dan umpan balik waktu nyata guna mendukung pemantauan di lapangan. Evaluasi kegunaan menggunakan System Usability Scale (SUS) menghasilkan skor keseluruhan sebesar 82,3 yang termasuk dalam kategori kegunaan sangat baik, menunjukkan tingkat kepuasan pengguna yang tinggi dan interaksi yang intuitif. Hasil penelitian menunjukkan bahwa integrasi UCD dan pembelajaran mesin meningkatkan kegunaan, keterlibatan pengguna, serta akurasi dokumentasi mangrove dalam kondisi lapangan. Secara keseluruhan, penelitian ini menyajikan solusi mobile berbasis UCD yang siap digunakan di lapangan dan menjembatani rekayasa kegunaan dengan pemantauan mangrove partisipatif sebagai model replikatif bagi pengembangan aplikasi ekologi yang inklusif.
Kata kunci: Carbon sequestration; mangrove monitoring; mobile application; user-centered design; usability evaluation
Abstract:Abstract: Asthma is a chronic respiratory disease that affects millions of people worldwide, making early detection crucial to prevent complications. This study aims to compare the performance of the Decision Tree and Random…
ndom Forest algorithms in classifying asthma based on clinical symptom data. The data were processed through feature selection and model training stages, then evaluated using accuracy, precision, recall, and F1-score.The experimental analysis revealed that the Random Forest algorithm surpassed the Decision Tree in all metrics, achieving 95.19% accuracy, 90.43% precision, 95.00% recall, and 93.00% F1-score. In contrast, the Decision Tree obtained 89.14% accuracy, 90.60% precision, 88.70% recall, and 89.70% F1-score. These results suggest that Random Forest is more robust and dependable, especially in managing complex and imbalanced medical datasets.
Keywords: asthma detection; decision tree; random forest; machine learning.
Abstrak: Asma merupakan penyakit pernapasan kronis yang memengaruhi jutaan orang di seluruh dunia sehingga deteksi dini sangat penting untuk mencegah komplikasi. Penelitian ini bertujuan membandingkan kinerja algoritma Decision Tree dan Random Forest dalam mengklasifikasikan asma berdasarkan data gejala klinis. Data diproses melalui tahapan seleksi fitur dan pelatihan model, kemudian dievaluasi menggunakan akurasi, presisi, recall, dan F1-score. Hasil penelitian menunjukkan bahwa Random Forest memberikan performa terbaik dengan akurasi 90.43%, presisi 95.00%, recall 95.00%, dan F1-score 93.00%. Sebaliknya, Decision Tree memperoleh akurasi 89.14%, presisi 90.60%, recall 88.70%, dan F1-score 89.70%. Hasil ini menunjukkan bahwa Random Forest lebih kuat dan dapat diandalkan, terutama dalam mengelola kumpulan data medis yang kompleks dan tidak seimbang.
Kata kunci: deteksi asma; decision tree; random forest; pembelajaran mesin.
Abstract:Abstract: The advancement of network security faces growing challenges as cyberattacks become more sophisticated. Traditional rule-based systems struggle with zero-day attacks and obfuscation techniques. This study examines…
nes the development trends of AI-based algo-rithms, particularly machine learning and deep learning, in threat detection. A literature review evaluates AI-driven approaches, including support vector machines, random for-est, deep neural networks, convolutional neural networks, and reinforcement learning. Findings show that AI enhances detection accuracy, adaptability, and reduces false posi-tives. Machine learning efficiently classifies known attacks, while deep learning excels in identifying complex patterns such as distributed denial-of-service and advanced persis-tent threats. Unsupervised learning improves anomaly detection without labeled data. However, AI models require high-quality data, substantial computational resources, and remain vulnerable to adversarial attacks. Despite these challenges, AI provides a dynam-ic and adaptive security solution, surpassing traditional systems. Future research should enhance AI scalability and resilience for evolving cybersecurity threats.
Keywords: anomaly detection; artificial intelligence; deep learning; machine learning; network security
Abstrak: Perkembangan keamanan jaringan menghadapi tantangan yang semakin besar seiring meningkatnya kompleksitas serangan siber. Sistem berbasis aturan tradisional kesulitan mendeteksi zero-day attack dan teknik penyamaran. Penelitian ini mengkaji tren pengembangan algoritma berbasis AI, khususnya machine learning dan deep learning, dalam deteksi ancaman. Literature review mengevaluasi pendekatan berbasis AI, termasuk support vector machines, random forest, deep neural networks, convolutional neural networks, dan reinforcement learning. Hasil penelitian menunjukkan bahwa AI meningkatkan akurasi deteksi, adaptabilitas terhadap ancaman baru, serta mengurangi false positive. Machine learning efektif mengklasifikasikan serangan yang telah diketahui, sementara deep learning unggul dalam mengenali pola kompleks seperti distributed denial-of-service dan advanced persistent threats. Unsupervised learning meningkatkan deteksi anomali tanpa memerlukan data berlabel. Namun, AI masih bergantung pada data berkualitas tinggi, sumber daya komputasi besar, dan rentan terhadap adversarial attack. Meskipun demikian, AI menawarkan solusi keamanan yang lebih dinamis dan adaptif dibandingkan sistem tradisional. Penelitian selanjutnya perlu difokuskan pada peningkatan skalabilitas dan ketahanan AI dalam menghadapi ancaman siber yang terus berkembang.
Kata kunci: deteksi anomali; jaringan keamanan; kecerdasan buatan; pembelajaran dalam; pembelajaran mesin
Abstract:Abstract: Breast cancer is the leading cause of death for women globally, exacerbated by late detection. This study proposes a breast cancer risk prediction framework using XGBoost with SelectKBest feature selection. It…
aims to improve the accuracy and efficiency of early detection through exploratory data analysis, coding, SMOTE to address class imbalance, and feature selection (k=29). As a result, the XGBoost model achieved 98.1% accuracy, 98.1% recall, 98.1% f1-score, and 98.2% precision on test data, highlighting the importance of feature selection. These results are promising in patient prioritization (triage) for further examination, helping medical personnel identify high-risk patients, thus improving resource allocation efficiency. These findings validate SelectKBest and pave the way for the development of a machine learning-based clinical decision support system for breast cancer early detection workflows. This research contributes significantly to the application of machine learning to support early breast cancer detection.
Keywords: breast cancer; feature selection; machine learning; risk prediction; XGBOOST.
Abstrak: Kanker payudara menjadi penyebab utama kematian wanita global, diperparah deteksi yang terlambat. Penelitian ini mengusulkan kerangka prediksi risiko kanker payudara menggunakan XGBoost dengan seleksi fitur SelectKBest. Tujuannya meningkatkan akurasi dan efisiensi deteksi dini melalui analisis data eksploratif, pengkodean, SMOTE untuk mengatasi ketidakseimbangan kelas, dan seleksi fitur (k=29). Hasilnya, model XGBoost mencapai akurasi 98.1%, recall 98.1%, f1-score 98.1%, dan presisi 98.2% pada data uji, menyoroti pentingnya seleksi fitur. Hasil ini menjanjikan dalam penentuan prioritas pasien (triage) untuk pemeriksaan lebih lanjut, membantu tenaga medis mengidentifikasi pasien berisiko tinggi, sehingga meningkatkan efisiensi alokasi sumber daya. Temuan ini memvalidasi SelectKBest dan membuka jalan bagi pengembangan sistem pendukung keputusan klinis berbasis machine learning untuk alur kerja deteksi dini kanker payudara. Penelitian ini berkontribusi signifikan dalam penerapan machine learning untuk mendukung deteksi dini kanker payudara.
Kata kunci: kanker payudara; pembelajaran mesin; prediksi risiko ; seleksi fitur; XGBOOST.
Abstract:Abstract: Heart disease is one of the leading causes of death worldwide, making early detection and accurate diagnosis crucial for reducing mortality rates and improving patient outcomes. This study aims to evaluate the…
effectiveness of four machine learning algorithms—Logistic Regression, Random Forest, Support Vector Machine (SVM), and K-Nearest Neighbors (KNN)—in predicting heart disease, with a focus on enhancing model performance using Linear Discriminant Analysis (LDA) for feature reduction. Among the models, SVM achieved the highest accuracy at 84.24%, followed by Logistic Regression at 83.70%. Although Random Forest and KNN showed lower accuracies, all models benefited from LDA's dimensionality reduction. This study suggests that SVM, combined with LDA, offers an optimal solution for early and accurate heart disease prediction in the healthcare industry.
Keywords: feature reduction; heart disease; linear discriminant analysis (LDA); machine learning; SVM
Abstrak: Penyakit jantung merupakan salah satu penyebab utama kematian di seluruh dunia, sehingga deteksi dini dan diagnosis yang akurat sangat penting untuk menurunkan angka kematian dan meningkatkan hasil pengobatan pasien. Penelitian ini bertujuan untuk mengevaluasi efektivitas empat algoritma pembelajaran mesin—Regresi Logistik, Random Forest, Support Vector Machine (SVM), dan K-Nearest Neighbors (KNN)—dalam memprediksi penyakit jantung, dengan fokus pada peningkatan kinerja model menggunakan Analisis Diskriminan Linear (LDA) untuk reduksi fitur. Di antara model yang diuji, SVM mencapai akurasi tertinggi sebesar 84,24%, diikuti oleh Regresi Logistik dengan 83,70%. Meskipun Random Forest dan KNN menunjukkan akurasi yang lebih rendah, semua model memperoleh manfaat dari reduksi dimensi yang diberikan oleh LDA. Studi ini menunjukkan bahwa SVM yang dikombinasikan dengan LDA merupakan solusi optimal untuk prediksi penyakit jantung secara dini dan akurat dalam industri kesehatan.
Kata kunci: linear discriminant analysis (LDA); machine learning; penyakit jantung; reduksi fitur; SVM.
Abstract:Abstract: Feature selection is a crucial process that is very important to improve the performance of machine learning models, in accordance with data preprocessing. The feature selection process can be considered as a global…
lobal combinatorial optimization problem in machine learning, which reduces the number of features, eliminates irrelevant data, and produces acceptable classification accuracy. The purpose of this study is to predict or determine the results of the electrical installation operation feasibility test based on data and obtain attribute selection features, and obtain accuracy level results. The Particle Swarm Optimization (PSO) approach is used to select the right characteristics to determine the results of the electrical installation operation feasibility test because attribute selection is needed in data analysis, because the PSO method will increase accuracy than just SVM in determining attribute selection. If SVM is used with PSO, the accuracy value is 96% and AUC is 0.994%, while the SVM method produces an accuracy level of 94.89% and AUC of 0.994%. With this finding, the accuracy value increases by 2%, making it a very good categorization category. It has been proven that the use of Particle Swarm Optimization (PSO) based algorithms can improve and improve results.
Keywords: PSO; SVM; Certification
Abstrak: Pemilihan fitur merupakan proses krusial yang sangat penting untuk meningkatkan kinerja model machine learning, sesuai dengan praproses data. Proses pemilihan fitur dapat dianggap sebagai masalah optimasi kombinatorial global dalam pembelajaran mesin, yang mengurangi jumlah fitur, menghilangkan data yang tidak relevan, dan menghasilkan akurasi klasifikasi yang dapat diterima. Tujuan dari penelitian ini adalah untuk memprediksi atau menentukan hasil uji kelayakan operasi instalasi listrik berdasarkan data dan memperoleh fitur pemilihan atribut, serta memperoleh hasil tingkat akurasi. Pendekatan Particle Swarm Optimization (PSO) digunakan untuk memilih karakteristik yang tepat untuk menentukan hasil uji kelayakan operasi instalasi listrik karena pemilihan atribut diperlukan dalam analisis data, karena metode PSO akan meningkatkan akurasi dari pada hanya SVM dalam menentukan pemilihan atribut. Jika SVM digunakan dengan PSO, nilai akurasinya adalah 96% dan AUC sebesar 0,994%, sedangkan metode SVM menghasilkan tingkat akurasi sebesar 94,89% dan AUC sebesar 0,994%. Dengan temuan ini, nilai akurasi meningkat sebesar 2%, menjadikannya kategori kategorisasi yang sangat baik. Telah terbukti bahwa penggunaan algoritma berbasis Particle Swarm Optimization (PSO) dapat meningkatkan dan memperbaiki hasil.
Kata kunci: PSO; SVM; Sertifikasi
Abstract:Abstract: Twitter occupies the top position of the most popular social media platform in Indonesia. Police and other related issues were the subject of much discussion. The aim of this research is to analyze public sentiment…
ment towards the National Police Agency using Twitter with the support vector machine method. The research started by crawling Twitter data. The data contains a total of 6,925 entries for three keywords. Next, we move on to the preprocessing stage consisting of (cleaning, case folding, tokenization, and filtering). Next is the tf-idf feature extraction stage, finally the classification and evaluation stage. The results of manual data inspection (73:27) showed accuracy of 70.66%, precision of 70.68%, and recall of 99.76%. Testing the second data (82:18), found accuracy 86%, precision 86.21%, recall 99.71%. The results of manual data checking (82:18) showed accuracy of 70.66%, precision of 70.68%, recall of 99.76%. Testing the second data (82:18), found accuracy 86%, precision 86.21%, recall 99.71%. From the data system testing results (80:20), accuracy was 87.55%, positive precision 87.53%, negative precision 88.24%, positive recall 99.48%, and negative recall. the rate is 99.48.% – The result is 21.43%. Data testing results (60:40) showed accuracy of 86.89%, positive precision of 86.84%, negative precision of 88.46%, positive recall of 99.61%, and negative recall of 16.43%. Single test data validation system (80:20), accuracy 87.55, overall test cross validation system (k fold 5 accuracy) 86.673%.
Keywords: data mining;police agencies;support vector machines
Abstrak: Twitter menduduki posisi teratas platform media sosial terpopuler di Indonesia. Polisi dan masalah terkait lainnya menjadi pokok bahasan banyak pembicaraan. Tujuan penelitian ini untuk menganalisis sentimen masyarakat terhadap Badan Kepolisian Nasional menggunakan Twitter dengan metode support vector machine. Penelitian dimulai dengan crawling data Twitter. Data memuat total 6.925 entri dari tiga kata kunci. Selanjutnya beralih ke tahap preprocessing terdiri dari (pembersihan, pelipatan kasus, tokenisasi, dan pemfilteran). Selanjutnya tahap ekstraksi fitur tf-idf, terakhir tahap klasifikasi dan evaluasi. Hasil pemeriksaan data manual (73:27) menunjukkan akurasi 70,66%, presisi 70,68%, dan recall 99,76%. Menguji data kedua (82:18), menemukan akurasi 86%, presisi 86,21%, recall 99,71%. Hasil pemeriksaan data secara manual (82:18) menunjukkan akurasi 70,66%, presisi 70,68%, recall 99,76%. Menguji data kedua (82:18), menemukan akurasi 86%, presisi 86,21%, recall 99,71%. Dari hasil pengujian sistem data (80:20), akurasi 87,55%, presisi positif 87,53%, presisi negatif 88,24%, recall positif 99,48%, dan recall negatif. tarifnya adalah 99,48.% – Hasilnya 21,43%. Hasil pengujian data (60:40) menunjukkan akurasi 86,89%, presisi positif 86,84%, presisi negatif 88,46%, recall positif 99,61%, dan recall negatif 16,43%. Uji tunggal sistem validasi data (80:20), akurasi 87,55, uji keseluruhan sistem validasi silang (akurasi k fold 5) 86,673%.
Kata Kunci: data mining;instansi kepolisian;mesin vektor pendukung