Abstract:Abstract: SMP Muhammadiyah 5 Samarinda still relies on manual evaluation with limited data analysis tools in predicting student academic achievement. This study aims develop a system for predicting the learning achievement…
nt of students at SMP Muhammadiyah 5 Samarinda using the Naive Bayes classification method. The dataset used consists of 192 student exam scores covering academic scores, attendance, parents’ education and income, and living conditions as independent variables, while the dependent variable is the achievement label (achieved or not achieved). The preprocessing stage includes label normalization, feature selection, and median imputation to handle missing data. The dataset was divided into 75% training data and 25%. The model was implemented as a pipeline consisting of a median imputer and a Gaussian Naive Bayes classifier. The evaluation results showed that the model achieved an accuracy of 79.2%, with a perfect recall value (1.00) in the high-achieving class and (0.64) in the low-achieving class. This shows that the model is quite effective in identifying high-achieving students. The trained model was then integrated into a Flask-based web application, which enables online predictions through a simple form interface, facilitating contextual interpretation. This system is expected to assist in educational decision-making by helping teachers identify students’ achievement levels early on and design more targeted learning interventions.
Keywords: academic performance; educational data mining; naive bayes; prediction system; student achievement
Abstrak: SMP Muhammadiyah 5 Samarinda masih bergantung pada evaluasi manual dengan alat analisis data terbatas dalam melakukan prediksi prestasi akademik siswa. Penelitian ini bertujuan mengembangkan sistem prediksi prestasi belajar siswa SMP Muhammadiyah 5 Samarinda menggunakan metode klasifikasi Naive Bayes. Dataset yang digunakan terdiri atas 192 data nilai ujian siswa yang mencakup skor akademik, kehadiran, pendidikan dan pendapatan orang tua, serta kondisi tempat tinggal sebagai variabel independen, sedangkan variabel dependen berupa label prestasi (berprestasi atau tidak berprestasi). Tahap preprocessing meliputi normalisasi label, seleksi fitur, serta imputasi median untuk menangani data yang hilang. Dataset dibagi menjadi 75% data latih dan 25%. Model diimplementasikan dalam bentuk pipeline yang terdiri atas median imputer dan Gaussian Naive Bayes classifier. Hasil evaluasi menunjukkan bahwa model mencapai akurasi sebesar 79,2%, dengan nilai recall sempurna (1,00) pada kelas berprestasi dan lebih rendah (0,64) pada kelas tidak berprestasi. Hal ini menunjukkan bahwa model cukup efektif dalam mengidentifikasi siswa berprestasi. Model yang telah dilatih kemudian diintegrasikan ke dalam aplikasi web berbasis Flask, yang memungkinkan prediksi secara daring melalui antarmuka formulir sederhana untuk mendukung interpretasi kontekstual. Sistem ini diharapkan dapat membantu untuk pengambilan keputusan dalam pendidikan dengan membantu guru mengidentifikasi tingkat prestasi siswa sejak dini dan merancang intervensi pembelajaran yang lebih terarah.
Kata kunci: prestasi akademik; penambangan data Pendidikan; naive bayes; sistem prediksi; prestasi siswa
Abstract:Abstract: Asthma is a chronic respiratory disease that affects millions of people worldwide, making early detection crucial to prevent complications. This study aims to compare the performance of the Decision Tree and Random…
ndom Forest algorithms in classifying asthma based on clinical symptom data. The data were processed through feature selection and model training stages, then evaluated using accuracy, precision, recall, and F1-score.The experimental analysis revealed that the Random Forest algorithm surpassed the Decision Tree in all metrics, achieving 95.19% accuracy, 90.43% precision, 95.00% recall, and 93.00% F1-score. In contrast, the Decision Tree obtained 89.14% accuracy, 90.60% precision, 88.70% recall, and 89.70% F1-score. These results suggest that Random Forest is more robust and dependable, especially in managing complex and imbalanced medical datasets.
Keywords: asthma detection; decision tree; random forest; machine learning.
Abstrak: Asma merupakan penyakit pernapasan kronis yang memengaruhi jutaan orang di seluruh dunia sehingga deteksi dini sangat penting untuk mencegah komplikasi. Penelitian ini bertujuan membandingkan kinerja algoritma Decision Tree dan Random Forest dalam mengklasifikasikan asma berdasarkan data gejala klinis. Data diproses melalui tahapan seleksi fitur dan pelatihan model, kemudian dievaluasi menggunakan akurasi, presisi, recall, dan F1-score. Hasil penelitian menunjukkan bahwa Random Forest memberikan performa terbaik dengan akurasi 90.43%, presisi 95.00%, recall 95.00%, dan F1-score 93.00%. Sebaliknya, Decision Tree memperoleh akurasi 89.14%, presisi 90.60%, recall 88.70%, dan F1-score 89.70%. Hasil ini menunjukkan bahwa Random Forest lebih kuat dan dapat diandalkan, terutama dalam mengelola kumpulan data medis yang kompleks dan tidak seimbang.
Kata kunci: deteksi asma; decision tree; random forest; pembelajaran mesin.
Abstract:Abstract: In the business world, supplier selection plays a crucial role in ensuring smooth company operations. Suppliers are responsible for providing raw materials with consistent quality, timely delivery, and competitive…
ive prices. The supplier selection process requires evaluation based on various criteria such as product quality, availability, packaging, price, and warranty. Currently, SNM Store places orders by contacting suppliers one by one via telephone to inquire about item availability. This method is time-consuming and may lead to delays in fulfilling item requirements. To address this issue, a Decision Support System (DSS) is needed to assist in efficiently determining the best supplier. One method that can be used in this system is MOORA (Multi-Objective Optimization on the Basis of Ratio Analysis). MOORA is known to be effective in handling multi-criteria decision-making by simultaneously optimizing multiple objectives. This method also reduces subjectivity by assigning weights to each criterion and uses simple and fast calculations to evaluate the available alternatives. The objectives of this research are to identify the key criteria in supplier selection, apply the MOORA method in an efficient and user-friendly evaluation and selection process, and improve the operational efficiency of SNM Store in procurement so that item availability can be ensured in a timely manner.
Keywords: decision support system ; MOORA; supplier
Abstrak: Dalam dunia bisnis, pemilihan supplier memegang peranan penting dalam memastikan kelancaran operasional perusahaan. Supplier bertanggung jawab menyediakan bahan baku dengan kualitas konsisten, pengiriman tepat waktu, dan harga kompetitif. Proses seleksi supplier memerlukan evaluasi terhadap berbagai kriteria seperti kualitas produk, ketersediaan, pengemasan, harga, dan garansi. Toko SNM saat ini melakukan pemesanan dengan menghubungi supplier satu per satu melalui telepon untuk menanyakan ketersediaan barang. Metode ini memakan waktu dan dapat menyebabkan keterlambatan dalam pemenuhan kebutuhan barang. Untuk mengatasi hal tersebut, diperlukan sistem pendukung keputusan (Decision Support System) yang dapat membantu dalam menentukan supplier terbaik secara efisien. Salah satu metode yang dapat digunakan dalam sistem ini adalah MOORA (Multi-Objective Optimization on the Basis of Ratio Analysis). MOORA dikenal efektif dalam menangani keputusan multi-kriteria dengan mengoptimalkan berbagai tujuan secara bersamaan. Metode ini juga mengurangi subjektivitas melalui pemberian bobot pada tiap kriteria dan menggunakan perhitungan yang sederhana serta cepat dalam mengevaluasi alternatif yang tersedia. adapun tujuan dari penelitian ini adalah untuk mengidentifikasi kriteria-kriteria penting dalam pemilihan supplier, menerapkan metode MOORA dalam proses evaluasi dan seleksi yang efisien dan mudah digunakan, serta meningkatkan efisiensi operasional Toko SNM dalam hal pengadaan barang agar ketersediaan barang dapat terjamin tepat waktu.
Kata kunci: MOORA; sistem penunjang keputusan; supplier;
Abstract:Abstract: Breast cancer is the leading cause of death for women globally, exacerbated by late detection. This study proposes a breast cancer risk prediction framework using XGBoost with SelectKBest feature selection. It…
aims to improve the accuracy and efficiency of early detection through exploratory data analysis, coding, SMOTE to address class imbalance, and feature selection (k=29). As a result, the XGBoost model achieved 98.1% accuracy, 98.1% recall, 98.1% f1-score, and 98.2% precision on test data, highlighting the importance of feature selection. These results are promising in patient prioritization (triage) for further examination, helping medical personnel identify high-risk patients, thus improving resource allocation efficiency. These findings validate SelectKBest and pave the way for the development of a machine learning-based clinical decision support system for breast cancer early detection workflows. This research contributes significantly to the application of machine learning to support early breast cancer detection.
Keywords: breast cancer; feature selection; machine learning; risk prediction; XGBOOST.
Abstrak: Kanker payudara menjadi penyebab utama kematian wanita global, diperparah deteksi yang terlambat. Penelitian ini mengusulkan kerangka prediksi risiko kanker payudara menggunakan XGBoost dengan seleksi fitur SelectKBest. Tujuannya meningkatkan akurasi dan efisiensi deteksi dini melalui analisis data eksploratif, pengkodean, SMOTE untuk mengatasi ketidakseimbangan kelas, dan seleksi fitur (k=29). Hasilnya, model XGBoost mencapai akurasi 98.1%, recall 98.1%, f1-score 98.1%, dan presisi 98.2% pada data uji, menyoroti pentingnya seleksi fitur. Hasil ini menjanjikan dalam penentuan prioritas pasien (triage) untuk pemeriksaan lebih lanjut, membantu tenaga medis mengidentifikasi pasien berisiko tinggi, sehingga meningkatkan efisiensi alokasi sumber daya. Temuan ini memvalidasi SelectKBest dan membuka jalan bagi pengembangan sistem pendukung keputusan klinis berbasis machine learning untuk alur kerja deteksi dini kanker payudara. Penelitian ini berkontribusi signifikan dalam penerapan machine learning untuk mendukung deteksi dini kanker payudara.
Kata kunci: kanker payudara; pembelajaran mesin; prediksi risiko ; seleksi fitur; XGBOOST.
Abstract:Abstract: One of the main health problems in children is stunting which is one of the concerns in the Sustainable Development Goals (SDGs). Specifically in Indonesia, the prevalence of stunting in 2024 is 21.6%. This figure…
ure is still relatively high, because the target prevalence of stunting is 14%. This study aims to implement machine learning knowledge through the Classification And Regression Trees (CART) algorithm based on Ant Be Colony (ABC) feature selection which aims to determine the increase in accuracy in analyzing stunting datasets. The data used comes from Kaggle which consists of 16500 datasets. The dataset consists of gender, age, birth length, birth weight, body length, body weight, breastfeeding and stunting status. The research methods used are data collection, data preprocessing, classification, and evaluation using K-fold cross validation. The results obtained in this research are the implementation of the CART algorithm obtained a value of 89.86% and the results of CART with Ant Be Colony (ABC) feature selection, which obtained an accuracy value of 93.65%. This shows that there is an increase in the accuracy value in the use of CART algorithm optimization and Ant Be Colony (ABC) feature selection by 3.76%. With the research results that have been obtained, it can be categorized as excellent accuracy value excellent. It is hoped that further research can be carried out by adding other classification algorithms or adding feature selection.
Keywords: classification; feature selection; optimazation; stunting
Abstrak: Salah satu masalah kesehatan utama pada anak adalah stunting yang menjadi salah satu perhatian dalam Sustainable Development Goals (SDGs). Khusus di Indonesia angka Pravelensi stunting pada tahun 2024 di angka 21.6%. Angka ini masih tergolong tinggi, karena target angka pravelensi stunting ialah 14%. Penelitian ini bertujuan untuk mengimplementasikan pengetahuan machine learning melalui algoritma Classification And Regression Trees (CART) berbasis seleksi fitur Ant Be Colony (ABC) yang bertujuan untuk mengetahui peningkatan akurasi dalam menganalisis dataset stunting. Data yang digunakan bersumber dari Kaggle yang terdiri dari 16500 dataset. Dataset terdiri dari jenis kelamin, usia, panjang lahir, berat lahir, panjangg badan, berat badan, menyusui dan status stunting. Metode penelitian yang digunakan adalah pengumpulan data, preprocessing data, klasifikasi, dan evaluasi menggunakan K-fold cross validation. Hasil yang diperoleh pada penelitian ini adalah Implementasi algoritma CART memperoleh nilai sebesar 89,86% dan hasil seleksi fitur CART dengan Ant Be Colony (ABC) memperoleh nilai akurasi sebesar 93,65%. Hal ini menunjukkan adanya peningkatan nilai akurasi pada penggunaan optimasi algoritma CART dan pemilihan fitur Ant Be Colony (ABC) sebesar 3,76%. Dengan hasil penelitian yang telah diperoleh dapat dikategorikan nilai akurasi yang diperoleh sangat baik. Diharapkan dapat dilakukan penelitian selanjutnya dengan menambahkan algoritma klasifikasi lain atau menambahkan seleksi fitur.
Kata kunci: klasifikasi; optimalisasi; seleksi fitur; stunting
Abstract:Abstract: One of the keys to the success of a company or agency in achieving certain goals is the workforce. However, finding the ideal partner that suits the needs of the organization or agency is difficult. Therefore,…
the selection of suitable potential partners is very important in order to be able to recruit partners who are competent in their fields and meet the company's expectations and meet all stages carried out by the organization. The Preference Selection Index method is the method used in selecting employees. The option that returns the highest Preference Index value after all criteria and alternatives have been calculated is the best option, or options selected. Based on research findings, Andreyanto Wijaya's alternative is the best alternative to be chosen as the company's partner with the highest score, which is 0.95346.
Keywords: decision support system; PSI; recruitment; partner
Abstrak: Salah satu kunci keberhasilan suatu perusahaan atau instansi dalam mencapai tujuan tertentu adalah tenaga kerjanya. Namun, menemukan Mitra ideal yang sesuai dengan kebutuhan organisasi atau instansi memang sulit. Oleh karena itu, pemilihan calon Mitra yang sesuai sangatlah penting agar dapat merekrut mitra yang berkompeten di bidangnya dan memenuhi harapan perusahaan serta memenuhi seluruh tahapan yang dilakukan oleh organisasi. Metode Preference Selection Index adalah metode yang digunakan dalam menseleksi pegawai. Pilihan yang menghasilkan nilai Indeks Preferensi tertinggi setelah semua kriteria dan alternatif dihitung adalah pilihan terbaik, atau pilihan yang terpilih. Berdasarkan temuan penelitian, alternatif Andreyanto Wijaya merupakan alternatif terbaik untuk dipilih menjadi mitra untuk perusahaan dengan skor tertinggi yaitu 0,95346.
Kata Kunci : sistem pendukung keputusan; PSI; rekrutmen; mitra
Abstract:Abstract: The habit of smoking is dangerous because of the addictive substances that make cigarettes addictive. Its addictive nature poses a significant risk, affecting personality with stress, depression and nervous disorders.…
orders. Body factors that indicate smoking include blood sugar levels, dental caries, and hemoglobin. To address this, research has been conducted with focused efforts to understand and address the risks associated with smoking and its impact on overall health. This research aims to choose the best method for predicting smokers by using feature selection techniques. The feature selection algorithms uses for that are Analysis of Variance (ANOVA), Recursive Feature Elimination (RFE), and Genetic Algorithm (GA) to select optimal attributes and uses the k-fold cross validation technique as the validation of the Artificial Neural Network algorithm. The data includes various parameters such as age, height, weight, vision, blood pressure, cholesterol, triglycerides, hemoglobin, AST, ALT, GTP, gender, dental caries and tartar. Hearing ability, urine protein content, and tartar were selected. The results showed that using the Analysis of Variance method showed higher accuracy (77.101%) compared to the Genetic Algorithm method (74.64%) and the Recursive Feature Elimination method (76.08%). Selection of relevant attributes increases the predictions and insights of the Artificial Neural Network model about the effects of smoking on health.
Keywords: artificial neural network; analysis of variance; genetic algorithm; recursive feature elimination; smoker prediction
Abstrak: Kebiasaan merokok berbahaya karena adanya zat adiktif yang membuat rokok menjadi ketagihan. Sifatnya yang membuat ketagihan menimbulkan risiko yang signifikan, mempengaruhi kepribadian dengan stres, depresi, dan gangguan saraf. Faktor tubuh yang mengindikasikan kebiasaan merokok antara lain kadar gula darah, karies gigi, dan hemoglobin. Untuk mengatasi hal ini, penelitian telah dilakukan dengan upaya terfokus untuk memahami dan mengatasi risiko yang terkait dengan merokok dan dampaknya terhadap kesehatan secara keseluruhan. Penelitian ini bertujuan untuk memilih metode terbaik dalam memprediksi perokok dengan menggunakan teknik seleksi fitur. Metode seleksi fitur yang digunakan adalah Analysis of Variance (ANOVA), Recursive Feature Elimination (RFE), dan Genetic Algorithm (GA) untuk memilih atribut yang optimal dan menggunakan teknik k-fold cross validation sebagai validasi algoritma Artificial Neural Network. Data tersebut mencakup berbagai parameter seperti umur, tinggi badan, berat badan, penglihatan, tekanan darah, kolesterol, trigliserida, hemoglobin, AST, ALT, GTP, jenis kelamin, karies gigi dan karang gigi. Kemampuan pendengaran, kandungan protein urin, dan karang gigi dipilih. Hasil penelitian menunjukkan bahwa penggunaan metode Analysis of Variance menunjukkan akurasi yang lebih tinggi (77,101%) dibandingkan dengan metode Genetic Algorithm (74,64%) dan metode Recursive Feature Elimination (76,08%). Pemilihan atribut yang relevan meningkatkan prediksi dan wawasan model Jaringan Syaraf Tiruan tentang dampak merokok terhadap kesehatan.
Kata kunci: artificial neural network; analysis of variance; genetic algorithm; prediksi perokok; recursive feature elimination
Abstract:Abstract: Some people in Sei Silau Timur Village in Buntu Pane, Kisaran, have low incomes with the existence of a government policy in the food management program that cooperates with Bulog to ease the burden on the community…
unity by distributing Raskin to villages where people have low incomes. And not all people get the chance to receive RASKIN because the quota is limited. There needs to be a selection in determining the eligibility of RASKIN for the right people and avoiding mistakes. The selection process can be completed using the application of computer science. Based on this, a decision support system is needed that can be used by the Sei Silau Timur village head's office staff in distributing RASKIN rice, which later this application can help and benefit the village community. This research uses the AHP method, which is carried out by comparing a matrix of several criteria and alternatives. The final assessment result is implementing the AHP method, where criterion 4, namely Total Income, is selected, with Alternative 1 named Selamet.
Keywords: AHP; public; RASKIN; selection; SPK
Abstrak : Sebagian dari masyarakat di Desa Sei Silau Timur di kecamatan Buntu Pane, Kisaran mempunyai penghasilan yang rendah. Dengan adanya kebijakan pemerintah dalam program penanggulangan pangan yang bekerja sama dengan pihak Bulog untuk meringankan beban masyarakat dengan menyalurkan raskin ke desa-desa yang masyarakatnya berpenghasilan yang rendah. Dan tidak semua masyarakat mendapatkan kesempatan penerimaan RASKIN karena kuotanya terbatas. Perlu dilakukan dengan seleksi dalam penentuan pemberian kelayakan RASKIN kepada orang-orang yang tepat dan menghindari kekeliruan. Proses seleksi tersebut dapat diselesaikan dengan menggunakan penerapan secara ilmu komputer. Bedasarkan hal tersebut maka diperlukan suatu sistem pendukung keputusan yang dapat dipergunakan oleh petugas kantor Kepala Desa Sei Silau Timur dalam proses pembagian beras RASKIN, yang nantinya aplikasi ini dapat membantu dan bermanfaat bagi masyarakat desa tersebut. Penelitian ini menggunakan metode AHP, dimana metode yang dilakukan dengan membandingkan matriks sejumlah kriteria dan alternatif. Hasil penilaian akhir yang terpilih merupakan implementasi dari metode AHP, dimana yang terpilih adalah kriteria 4 yaitu Jumlah Penghasilan dengan alternatif 1 bernama Selamet.
Kata Kunci: AHP; masyarakat; RASKIN; seleksi; SPK
Abstract:Abstract: Weighted Product (WP) Methodology Implementation System for Employee Recruitment at PT. Web-Based XYZ conducted research on decision support systems with a website platform for PT. XYZ. The data collection method…
od was carried out for research using the literature study method from existing theories, interviews, several discussions as well as questions and observations at research sites. Using the Weighted Product (WP) Methodology aims to provide a solution to the problems that exist at PT. XYZ, for the basis of a computational assessment. PT assistant system. XYZ to conduct elections in determining employees who are selected from the best of all existing candidates. As well as the selection presented in the system. Research shows that this website system can make it easier for PT. XYZ to make selections in choosing prospective employees with specifications with the help of the Weighted Product (WP) methodology. So it can be said that the values and results that can be displayed still provide eligibility and suitability of the system that can be applied the same as the manual system that runs for the selection of new PT employees. XYZ.
Keywords: Methodology Weighted Product; SPK; Website; Warehouse
Abstrak: Sistem Penerapan Metodologi Weighted Product (WP) Untuk Penerimaan Karyawan di PT. XYZ Berbasis Web melakukan riset tentang sistem pendukung keputusan dengan platform website untuk PT. XYZ. Metode pengambilan data-data dikerjakan untuk riset me-manfaatkan metode studi pustaka dari teori-teori yang ada, wawancara beberapa diskusi serta pertanyaan dan observasi ke tempat riset. Menggunakan Metodologi Weighted Product (WP) bertujuan agar memberikan solusi dari masalah yang ada pada pada PT. XYZ, untuk dasar penilaian secara perhitungan. Sistem pembantu PT. XYZ agar melakukan pemilihan dalam menentukan karyawan yang terpilih dari yang terbaik dari semua kandi-dat yang ada. Serta penseleksian disajikan dalam sistem. Pada riset menampilkan kalua sistem website ini bisa memudahkan PT. XYZ untuk melakukan pemilihan dalam memilih calon karyawan dengan spesifikasi oleh bantuan metodologi Weighted Product (WP). Jadi bisa dikatakan kalau nilai dan hasil dapat ditampilkan masih memberikan kelayakan serta kecocokan sistem dapat diterapkan sama seperti manual sistem yang berjalan untuk seleksi karyawan baru PT. XYZ.
Kata kunci: Metodologi Weighted Product; SPK; Website; Warehouse
Abstract:Abstract: Paskibra selection is an annual agenda held by schools, district disporas, provincial disporas, and the Ministry of Youth and Youth. This activity aim select the best students who will serve as flag raisers at…
independence commemoration ceremonies and other holidays. Paskibra participants have to choose. This reliable, formidable and attractive students are choosen. So the flag raising can be carried out solemnly and well. This school has a large number of students. Paskibra extracurricular enthusiasts also have many enthusiasts. This school Paskibra is a favourite extracurricular and quite prestigious among students. The selection of Paskibra has been running so well, but the decisions taken are sometimes not by the standards procedures. Therefore, a system that will be a reference for objective decision-making need to created . The decision-making system using the data mining algorithm C4.5. This study aim to create a system that makes it easier for the selection committee to select eligible Paskibra members. The method used is a qualitative method in the form of the results of interviews with data from participants in the last three years of the Pakskibra selection. As a result, there are three main criteria and five rules of the selection system.
Keywords: C4.5 algorithm; data mining; paskibra
Abstrak: Seleksi paskibra merupakan agenda tahunan yang diadakan oleh sekolah, dispora kabupaten, dispora provinsi, dan kemenpora untuk memilih siswa-siswi terbaik yang akan bertugas sebagai pengibar bendera pada upacara peringatan kemerdekaan dan hari-hari besar lainnya. Peserta paskibra perlu diseleksi agar terpilih siswa-siswi yang handal, tangguh dan menarik sehingga pengiabaran bendera dapat dilaksanakan dengan khidmad dan baik. Sekolah ini adalah salah satu sekolah menengah atas yang menjadi favorit para lulusan SMP. Oleh karena itu sekolah ini mempunyai siswa yang sangat banyak. Dengan banyaknya siswa yang masuk, maka peminat ekskul paskibra juga memiliki peminat yang banyak, selain itu di sekolah ini paskibra merupakan ekskul favorit dan cukup bergengsi di kalangan siswa. Seleksi paskibra yang berjalan selama ini sudah dilakukan dengan baik, akan tetapi keputusan yang diambil terkadang tidak sesuai dengan standar yang telah ditetapkan. Oleh karena itu perlu dibuatkan sebuah sistem yang akan menjadi acuan untuk pengambilan keputusan yang objektif. Sistem pengambilan keputusan akan dibuat menggunakan data mining algoritma C4.5. Tujuan dari penelitian ini adalah membuat sebuah sistem yang memudahkan panitia penyeleksi untuk memilih anggota paskibra yang layak. Metode yang digunakan adalah metode kualitatif berupa hasil wawancara data peserta seleksi pakskibra tiga tahun terakhir. Hasilnya berupa tiga kriteria utama dan lima aturan sistem seleksi.
Kata kunci: Algoritma C4.; data mining; paskibra;