Abstract:Abstrak: Bentuk aplikasi dari serangkaian teori pendidikan yang telah dipelajari di dalam kampus tentunya akan lebih bermanfaat apabila teori-teori ilmu tersebut kita bagi kepada masyarakat. Kegiatan inilah yang disebut…
dengan pengabdian kita kepada masyarakat. Sebagai seorang akademisi baik dosen dan mahasiswa harus mampu bekerjasama dalam meujudkan Tri Darma perguruan tinggi dimana tempat kita membagi dan menimba ilmu pengetahuan. Pengabdian kepada masyarakat adalah tindakan nyata yang dapat kita lakukan untuk menambah wawasan masyarakat terhadap informasi yang akan kita bagikan, sehingga membawa kontribusi positif dalam masyarakat. Apalagi sekarang lagi hangat-hangatnya memperbincangkan tentang pemilihan kepala daerah, oleh karena itu penyuluhan tentang kepemimpinan dianggap perlu untuk di sosialisasikan kepada masyarakat. Harapan kedepannya adalah masyarakat mampu memilih pemimpin yang dapat menjadi contoh baik dalam setiap tindakan dan perkataannnya. Masyarakat diharapkan lebih hati-hati dalam memilih calon kepala daerah, tidak mudah terpengaruh citra dan kekuasaan yang dapat mendatangkan kerudian dalam masyarakat itu nantinya. Selain itu masyarakat tidak perlu takut terhadap tekanan yang mungkin saja datang untuk memaksa memilih jagoan mereka, masyarakat harus mendapatkan pencerahan tentang bagaimana hukum itu berlaku di kalangan masyarakat. Untuk itu selain membahas masalah kepemimpinan Universitas asahan juga bekerjasama dengan Yayasan Lembaga Bantuan Hukum – Cakrawana Nusantara Indonesia untuk memberi pemahaman kepada masyarakat tentang hukum, apa yang harus dilakukan masyarakat apabila tersangkut permasalahan hukum di lingkungannya, mengetahui hak dan kewajibannya dalam mentaati hukum tersebut. Harapan terbesarnya masyarakat di desa antara tidak tabu lagi terhadap permasalahan hukum, masyarakat desa antara berani untuk menghadapai permasalahan hukum yang mereka hadapi, masyarakat desa antara mampu memilih pemimpin yang tepat untuk memimpin daerah mereka.
Kata kunci: Kepemimpinan, Bantuan Hukum, Masyarakat Marginal
Abstract: The application form of a series of educational theories that have been studied on campus will certainly be more useful if the theories of science are shared for the community. This activity is called our devotion to the community. As an academic both lecturers and students should be able to work together in realizing Tri Darma college where we share and gain knowledge. Community service is a real action that we can do to increase society's insight into the information we will share, thus bringing a positive contribution to society. Especially now more warmly discussed about the election of regional heads, therefore counseling about leadership is considered necessary for the socialization to the community. The future expectation is that people are able to choose leaders who can be good examples in every action and perfomance. The community is expected to be more careful in choosing candidates for regional heads, not easily influenced by the image and power that can bring in the society later. In addition people should not be afraid of the pressures that might come to force their heroes, the public should get an enlightenment about how the law applies to the public. In addition to discussing the issue of leadership, the University of Asahan also cooperates with the Legal Aid Foundation - Cakrawana Nusantara Indonesia to provide an understanding to the public about the law, what should the community do when it comes to legal issues in its environment, knowing its rights and obligations in complying with the law. The greatest hope of the community in the village between no longer taboo on legal issues, the villagers between daring to face the legal problems they face, the villagers between able to choose the right leader to lead their area.
Keywords: Leadership, Legal Aid, Marginal Society
Abstract:Abstract: Student graduation is an urgent matter that is an indicator of the success of a university in producing its learning output. Several factors influence student graduation such as GPA, attendance, late taking credits,…
dits, and lack of student involvement in academic activities. The urgency of this research, universities need a method that is able to predict student graduation early so that it can provide academic intervention to students who have the potential to experience delays or fail to graduate. However, limited access to real academic data is often an obstacle in the development of predictive models, Therefore, this study aims to implement the XGBoost algorithm to predict student graduation based on several academic variables, namely the Cumulative Grade Point Average (GPA), the number of credits taken, the percentage of attendance, and the average grade of students. Model training using the XGBoost algorithm using a simulation dataset of 500 students who are labeled as graduating into two classes, namely passed and failed. The results of the study showed that the classification performance was very good with an accuracy value of 99.6%, Precision 99.7%, recall 99.4%.
Keywords: xgboost algorithm; data mining; student graduation
Abstrak: Kelulusan mahasiswa merupakan hal urgensi yang menjadi indikator keberhasilan sebuah perguruan tinggi dalam menghasilkan output pembelajarannya. Beberapa Faktor yang mempengaruhi kelulusan mahasiswa seperti IPK, kehadiran, keterlambatan pengambilan SKS, serta kurangnya keterlibatan mahasiswa dalam aktifitas akademik. Yang menjadi urgensi penelitian ini, Perguruan tinggi memerlukan suatu metode yang mampu memprediksi kelulusan mahasiswa secara dini sehingga dapat memberikan intervensi akademik kepada mahasiswa yang berpotensi mengalami keterlambatan atau tidak lulus. Namun, keterbatasan akses terhadap data akademik riil sering menjadi kendala dalam pengembangan model prediksi, Oleh karena itu, penelitian ini bertujuan mengimplementasikan algoritma XGBoost untuk memprediksi kelulusan mahasiswa berdasarkan beberapa variabel akademik, yaitu Indeks Prestasi Kumulatif (IPK), jumlah SKS yang ditempuh, persentase kehadiran, dan nilai rata-rata mahasiswa. Pelatihan model menggunakan algoritma XGBoost dengan menggunakan dataset simulasi 500 mahasiswa yang diberi label kelulusan menjadi dua kelas yaitu lulus dan tidak lulus. Hasil penelitian menunjukan bahwa performance klasifikasi yang sangat baik dengan nilai accurasi sebesar 99,6%, Precision 99,7%, recall 99,4%.
Kata kunci: algoritma xgbosst; kelulusan mahasiswa; penambangan data
Abstract:Abstract: Anomalous sound detection is essential for industrial predictive maintenance, as machine failures often originate from subtle acoustic changes during operation. However, high background noise and limitations of…
conventional Convolutional Neural Networks (CNN) reduce detection reliability. This study proposes a 1D-CNN-based anomaly detection framework with multi-view feature fusion and temporal segmentation to enhance detection performance. The approach combines MFCC, Log-Mel Spectrogram, and Chroma STFT features, while temporal segmentation divides audio signals into 5-second segments to better capture transient anomalies. Experiments on the MIMII dataset under varying Signal-to-Noise Ratio (SNR) conditions show that MFCC and Log-Mel fusion achieves the best performance, with 97.90% accuracy and ROC-AUC of 0.9789. The model maintains accuracy above 90% at −6 dB, demonstrating strong robustness in noisy industrial environments.
Keywords: industrial anomaly detection; 1D-CNN; multi-view feature fusion; temporal segmentation; MIMII dataset.
Abstrak: Deteksi anomali suara merupakan komponen penting dalam sistem pemeliharaan prediktif industri, karena kegagalan mesin sering diawali oleh perubahan akustik yang bersifat halus selama proses operasi. Namun, tingkat kebisingan yang tinggi serta keterbatasan arsitektur Convolutional Neural Network (CNN) konvensional dapat menurunkan keandalan deteksi. Penelitian ini bertujuan mengusulkan kerangka deteksi anomali berbasis 1D-CNN yang mengintegrasikan strategi fusi fitur multi-view dan segmentasi temporal untuk meningkatkan kinerja deteksi. Pendekatan yang digunakan menggabungkan fitur MFCC, Log-Mel Spectrogram dan Chroma STFT, sementara teknik temporal splitting membagi sinyal audio menjadi segmen berdurasi 5 detik untuk menangkap anomali yang bersifat sementara. Eksperimen menggunakan dataset MIMII pada berbagai kondisi Signal-to-Noise Ratio (SNR) menunjukkan bahwa kombinasi MFCC dan Log-Mel Spectrogram menghasilkan kinerja terbaik dengan akurasi 97,90% dan ROC-AUC sebesar 0,9789. Model juga mempertahankan akurasi di atas 90% pada kondisi kebisingan ekstrem (−6 dB) yang menunjukkan ketahanan yang baik dalam lingkungan industri yang bising.
Kata kunci: deteksi anomali industri; 1D-CNN; fusi fitur multi-view; segmentasi temporal; dataset MIMII
Abstract:Abstract: Accurate forecasts of tea harvest production are important for workforce planning, factory operations, and marketing decisions, yet conventional estimation in plantations often relies on field experience and can…
n be biased and less adaptive to changing conditions. This study aims to develop a Random Forest Regression model to predict tea harvest production at the Bah Butong tea plantation using historical operational and climate-related data. The dataset consists of 60 monthly records (2020–2024) with six predictor variables: rainfall (mm), number of rainy days, pest level, weed level, number of harvested trees and land area. Data were split into 80% training (48 samples) and 20% testing (12 samples). Model hyperparameters were optimized using RandomizedSearchCV with RepeatedKFold cross-validation (5 folds, 3 repeats). The tuned model achieved MSE of 668,980,524.45, RMSE of 25,864.66 kg, MAE of 19,838.69 kg, and MAPE of 7.59% on the test set. The results indicate that the model can provide practical production estimates, with errors averaging about 7–8% of the actual production. Feature importance analysis shows that the number of harvested tea bushes and cultivated area contribute most to predictions. Future work should extend the historical period and incorporate time-based features (seasonality/lag) for improved forecasting.
Keywords: hyperparameter tuning; production prediction; random forest; regression; tea harvest
Abstrak: Perkiraan akurat produksi panen teh sangat penting untuk perencanaan tenaga kerja, operasional pabrik, dan keputusan pemasaran, namun estimasi konvensional di perkebunan seringkali bergantung pada pengalaman lapangan dan dapat bias serta kurang adaptif terhadap perubahan kondisi. Studi ini bertujuan untuk mengembangkan model Regresi Random Forest untuk memprediksi produksi panen teh di perkebunan teh Bah Butong menggunakan data operasional dan data terkait iklim historis. Dataset terdiri dari 60 catatan bulanan (2020–2024) dengan enam variabel prediktor: curah hujan (mm), jumlah hari hujan, tingkat hama, tingkat gulma, jumlah pokok panen, dan luas lahan. Data dibagi menjadi 80% data pelatihan (48 sampel) dan 20% data pengujian (12 sampel). Parameter model dioptimalkan menggunakan RandomizedSearchCV dengan validasi silang RepeatedKFold (5 lipatan, 3 pengulangan). Model yang telah disempurnakan mencapai MSE sebesar 668.980.524,45, RMSE sebesar 25.864,66 kg, MAE sebesar 19.838,69 kg, dan MAPE sebesar 7,59% pada set data uji. Hasil tersebut menunjukkan bahwa model dapat memberikan estimasi produksi yang praktis, dengan kesalahan rata-rata sekitar 7–8% dari produksi aktual. Analisis kepentingan fitur menunjukkan bahwa jumlah semak teh yang dipanen dan luas lahan budidaya paling berkontribusi pada prediksi. Pekerjaan selanjutnya harus memperpanjang periode historis dan menggabungkan fitur berbasis waktu (musiman/lag) untuk peramalan yang lebih baik.
Kata kunci: panen teh; prediksi produksi; random forest; regresi; tuning parameter
Abstract:Abstract: Automated batik motif classification is challenged by high inter-class similarity and texture complexity. This study proposes a hybrid model integrating MobileNetV2 as a feature extractor and Support Vector Machine…
hine (SVM) as the classifier to optimize accuracy and efficiency. Utilizing a Kaggle dataset of 8,640 images across 20 batik categories, the data was partitioned into 420 training images per class (Dayak: 360) and 15 testing images per class. The results demonstrate superior performance with 96.00% accuracy, exceeding the 90% target. The system showed high computational efficiency with a total execution time of 359.92 seconds and feature extraction taking only 22.63 seconds. This hybrid approach provides an ideal performance balance for resource-constrained mobile applications.
Keywords: batik classification; MobileNetV2; support vector machine; hybrid model; computational efficiency
Abstrak: Klasifikasi motif batik secara otomatis menghadapi tantangan kemiripan visual antar-kelas yang tinggi. Penelitian ini bertujuan mengoptimalkan akurasi dan efisiensi pengenalan batik menggunakan model hibrida MobileNetV2 sebagai pengekstraksi fitur dan Support Vector Machine (SVM) sebagai klasifikator. Menggunakan dataset Kaggle berisi 8.640 citra dari 20 kategori batik, data dibagi menjadi 420 citra latih per kelas (kecuali Batik Dayak 360) dan 15 citra uji per kelas. Hasil eksperimen menunjukkan performa impresif dengan akurasi 96,00%, melampaui target awal 90%. Sistem ini sangat efisien dengan total waktu eksekusi 359,92 detik, di mana ekstraksi fitur hanya membutuhkan 22,63 detik. Kombinasi MobileNetV2 dan SVM memberikan keseimbangan performa ideal untuk implementasi pada perangkat bergerak dengan sumber daya terbatas.
Kata kunci: klasifikasi batik; MobileNetV2; Support Vector Machine; Hybrid Model; efisiensi komputasi
Abstract:Abstract: Academic achievement mapping is an important process in higher education to support effective academic monitoring and guidance. In practice, student grouping is often conducted manually by academic staff using…
simple criteria such as Grade Point Average (GPA) thresholds and subjective judgment, without systematic data analysis. This study aims to apply the Fuzzy C-Means (FCM) clustering algorithm to objectively group students based on their academic achievement levels. The dataset consists of academic records from 179 sixth-semester students of the Computer Science Study Program at Universitas Islam Negeri Sumatera Utara, where 160 eligible students are processed in the FCM calculation. Three variables are used: cumulative GPA, total completed credits, and the total number of low grades (D/E). The FCM algorithm automatically performs the mapping and groups students into three categories, namely excellent, stable, and at-risk students. Cluster quality is evaluated using the Silhouette Score and Davies–Bouldin Index, showing satisfactory clustering performance. The results indicate that the proposed approach provides a data-driven and objective basis for academic decision support.
Keywords: academic achievement; clustering; fuzzy c-means; student
Abstrak: Pemetaan pencapaian akademik mahasiswa merupakan proses penting dalam pendidikan tinggi untuk mendukung pemantauan dan pembinaan akademik yang tepat sasaran. Dalam praktiknya, pengelompokan mahasiswa masih sering dilakukan secara manual oleh pihak akademik berdasarkan kriteria sederhana, seperti batasan Indeks Prestasi Kumulatif (IPK) dan penilaian subjektif, tanpa analisis data yang sistematis. Penelitian ini bertujuan menerapkan algoritma Fuzzy C-Means (FCM) untuk mengelompokkan mahasiswa secara objektif berdasarkan tingkat pencapaian akademik. Data penelitian berasal dari 179 mahasiswa semester enam Program Studi Ilmu Komputer Universitas Islam Negeri Sumatera Utara, dengan 160 mahasiswa memenuhi kriteria dan diproses menggunakan algoritma FCM. Variabel yang digunakan meliputi IPK kumulatif, jumlah SKS yang telah ditempuh, dan total nilai rendah (D/E). Proses pemetaan sepenuhnya dilakukan oleh algoritma FCM dan menghasilkan tiga kategori mahasiswa, yaitu unggul, stabil, dan berisiko. Evaluasi menggunakan Silhouette Score dan Davies–Bouldin Index menunjukkan kualitas pengelompokan yang cukup baik.
Kata kunci: fuzzy c-means; clustering; mahasiswa; pencapaian akademik
Abstract:Abstract: Malaria remains a major global health problem, particularly in tropical countries such as Indonesia. Accurate early diagnosis is essential for reducing malaria-related morbidity and mortality. Conventional microscopic…
oscopic examination is time-consuming, highly dependent on expert personnel, and prone to human error. This study compares the performance of two Convolutional Neural Network (CNN) architectures, ResNet-50 and DenseNet-121, for malaria image classification. The Cell Images for Malaria dataset provided by the National Institutes of Health (NIH) through Kaggle was used, consisting of 27,558 microscopic blood cell images categorized into Parasitized and Uninfected classes. The dataset was divided into 80% training data and 20% testing data. Image preprocessing included resizing to 224 × 224 pixels, normalization, labeling, and data augmentation using RandomFlip, RandomRotation, RandomZoom, and RandomContrast. Experimental results showed that the ResNet-50 model trained for 100 epochs achieved the highest performance, with an accuracy of 95.54% and precision, recall, and F1-score of 0.96. The confusion matrix indicated 5,272 correctly classified images out of 5,510 testing samples. These findings demonstrate that ResNet-50 outperformed DenseNet-121 and has strong potential for supporting accurate, reliable, and efficient computer-aided malaria diagnosis based on microscopic blood smear images.
Keywords: computer-aided diagnosis; convolutional neural network (CNN); densenet-121; early detection; image classification; malaria; microscopic blood smear images; resnet-50;
Abstrak : Malaria masih menjadi masalah kesehatan global yang serius, terutama di negara tropis seperti Indonesia. Diagnosis dini yang akurat sangat penting untuk menurunkan angka morbiditas dan mortalitas. Metode konvensional berupa pemeriksaan mikroskopis memiliki keterbatasan karena memerlukan waktu yang relatif lama, bergantung pada tenaga ahli, dan berpotensi menimbulkan kesalahan manusia. Penelitian ini bertujuan membandingkan kinerja arsitektur Convolutional Neural Network (CNN) yaitu ResNet-50 dan DenseNet-121 dalam klasifikasi citra malaria. Dataset yang digunakan berasal dari Cell Images for Malaria yang disediakan oleh National Institutes of Health (NIH) melalui platform Kaggle, terdiri dari 27.558 citra dengan pembagian 80% data latih, 20% data validasi. Tahap praproses meliputi cleaning, resizing citra menjadi 224×224 piksel, normalisasi, labeling, serta data augmentasi menggunakan RandomFlip, RandomRotation, RandomZoom, dan RandomContrast. Hasil pengujian menunjukkan bahwa model ResNet-50 pada epoch 100 memperoleh akurasi sebesar 95,54% dengan nilai precision, recall, dan F1-score masing-masing sebesar 0,96. Confusion matrix menunjukkan jumlah prediksi benar sebanyak 5.272 dari total 5.510 data uji. Hasil ini menunjukkan bahwa arsitektur CNN mampu mengklasifikasikan citra malaria dengan tingkat akurasi yang tinggi dan memiliki kemampuan generalisasi yang baik terhadap data baru. Penelitian ini memberikan kontribusi dalam evaluasi performa arsitektur CNN untuk mendukung pengembangan sistem diagnosis malaria berbasis citra mikroskopis yang lebih cepat dan akurat.
Kata kunci: convolutional neural network (CNN); citra mikroskopis hapusan darah; densenet-121; diagnosis berbantuan komputer; deteksi dini; klasifikasi citra; malaria; resnet-50
Abstract:Abstract: The implementation of dress code regulations in university environments is generally still carried out conventionally, requiring significant time and effort and potentially leading to subjective assessments. This…
is study develops an automatic student dress code compliance detection system using computer vision based on the YOLOv8 model. The dataset consists of 1,800 annotated images divided into eight clothing categories, split into 78% training (1,404 images), 14% validation (254 images), and 8% testing (143 images). All images underwent preprocessing and data augmentation before training the YOLOv8 model with an input size of 640×640 pixels for 50 epochs. During testing, the YOLOv8 model achieved an overall performance of Precision 0.844, Recall 0.773, F1-Score 0.802, and mAP@0.5 0.841, and was able to detect clothing objects with good accuracy and stable performance under various image conditions. The system was integrated with a Flask-based backend and a web-based frontend to enable real time detection and compliance classification, with a response time of less than 2 seconds, supporting automatic and consistent identification of student dress code compliance as “Compliant” or “Violation.”
Keywords: compliance detection; computer vision; dress code regulations; real time detection; YOLOv8.
Abstrak: Penerapan aturan berpakaian di lingkungan kampus umumnya masih dilakukan secara konvensional sehingga membutuhkan waktu dan tenaga yang relatif besar serta berpotensi menimbulkan subjektivitas penilaian. Penelitian ini bertujuan mengembangkan sistem pendeteksi kepatuhan berpakaian mahasiswa secara otomatis berbasis visi komputer menggunakan model YOLOv8. Dataset yang digunakan terdiri dari 1.800 citra beranotasi yang terbagi ke dalam 8 kategori pakaian, dengan pembagian data sebesar 78% data latih (1.404 citra), 14% data validasi (254 citra) dan 8% data uji (143 citra). Seluruh citra diproses melalui tahapan pre-processing dan data augmentation, kemudian digunakan untuk melatih model YOLOv8 dengan ukuran input 640×640 piksel selama 50 epoch. Pada tahap pengujian, model mencapai performa keseluruhan dengan Precision 0.844, Recall 0.773, F1-Score 0.802, dan mAP@0.5 0.841, serta mampu mendeteksi objek pakaian dengan akurasi baik dan performa stabil pada berbagai kondisi citra. Sistem kemudian diintegrasikan dengan backend berbasis Flask dan frontend web untuk mendukung proses deteksi waktu nyata dan klasifikasi kepatuhan, dengan waktu respons sistem kurang dari 2 detik, sehingga mampu mengidentifikasi status kepatuhan berpakaian mahasiswa ke dalam kategori “Aman” dan “Melanggar Aturan” secara otomatis dan konsisten.
Kata kunci: aturan berpakaian; deteksi waktu nyata; pendeteksi kepatuhan; visi komputer; YOLOv8.
Abstract:Abstract: Obesity is an escalating global health concern, with unhealthy lifestyle patterns contributing significantly to its development. This study aims to evaluate and compare three clustering techniques for categorizing…
ing lifestyle patterns and obesity-related factors: K-Means, Agglomerative Clustering, and Gaussian Mixture Model (GMM). The data used in this study is sourced from the Food Nutrition dataset, which includes variables such as dietary habits, physical activity, and socio-economic status. The three clustering methods were assessed using evaluation metrics such as Silhouette Score, Davies-Bouldin Index (DBI), and Calinski-Harabasz Index (CHI). The findings revealed that K-Means exhibited the best performance in terms of cluster separation with a Silhouette Score of 0.5559, while GMM showed better flexibility in handling more complex data. Although Agglomerative Clustering produced acceptable results, it had a higher overlap between clusters compared to the other methods. This study offers valuable insights into selecting the most appropriate clustering technique based on the data characteristics.
Keywords: agglomerative; clustering; GMM; k-means; lifestyle patterns; obesity
Abstrak: Obesitas menjadi masalah kesehatan yang semakin meningkat di seluruh dunia, dengan pola hidup yang tidak sehat berperan besar dalam perkembangannya. Penelitian ini bertujuan untuk membandingkan tiga metode clustering dalam mengelompokkan pola gaya hidup dan faktor yang memengaruhi obesitas, yaitu K-Means, Agglomerative Clustering, dan Gaussian Mixture Model (GMM). Data yang digunakan diperoleh dari dataset Food Nutrition yang mencakup informasi terkait pola makan, aktivitas fisik, serta faktor sosial-ekonomi. Ketiga metode tersebut diuji dengan menggunakan beberapa metrik evaluasi, seperti Silhouette Score, Davies-Bouldin Index (DBI), dan Calinski-Harabasz Index (CHI). Hasil penelitian menunjukkan bahwa K-Means memiliki kinerja terbaik dalam hal pemisahan klaster, dengan nilai Silhouette Score sebesar 0.5559, sementara GMM lebih fleksibel dalam menangani data yang lebih kompleks. Meskipun Agglomerative Clustering memberikan hasil yang dapat diterima, tumpang tindih antar klaster lebih besar dibandingkan dengan kedua metode lainnya. Penelitian ini memberikan pemahaman yang lebih baik mengenai pemilihan metode clustering yang tepat berdasarkan karakteristik data yang digunakan.
Kata kunci: agglomerative; clustering; GMM; k-means; obesitas; pola gaya hidup
Abstract:Abstract: SMP Muhammadiyah 5 Samarinda still relies on manual evaluation with limited data analysis tools in predicting student academic achievement. This study aims develop a system for predicting the learning achievement…
nt of students at SMP Muhammadiyah 5 Samarinda using the Naive Bayes classification method. The dataset used consists of 192 student exam scores covering academic scores, attendance, parents’ education and income, and living conditions as independent variables, while the dependent variable is the achievement label (achieved or not achieved). The preprocessing stage includes label normalization, feature selection, and median imputation to handle missing data. The dataset was divided into 75% training data and 25%. The model was implemented as a pipeline consisting of a median imputer and a Gaussian Naive Bayes classifier. The evaluation results showed that the model achieved an accuracy of 79.2%, with a perfect recall value (1.00) in the high-achieving class and (0.64) in the low-achieving class. This shows that the model is quite effective in identifying high-achieving students. The trained model was then integrated into a Flask-based web application, which enables online predictions through a simple form interface, facilitating contextual interpretation. This system is expected to assist in educational decision-making by helping teachers identify students’ achievement levels early on and design more targeted learning interventions.
Keywords: academic performance; educational data mining; naive bayes; prediction system; student achievement
Abstrak: SMP Muhammadiyah 5 Samarinda masih bergantung pada evaluasi manual dengan alat analisis data terbatas dalam melakukan prediksi prestasi akademik siswa. Penelitian ini bertujuan mengembangkan sistem prediksi prestasi belajar siswa SMP Muhammadiyah 5 Samarinda menggunakan metode klasifikasi Naive Bayes. Dataset yang digunakan terdiri atas 192 data nilai ujian siswa yang mencakup skor akademik, kehadiran, pendidikan dan pendapatan orang tua, serta kondisi tempat tinggal sebagai variabel independen, sedangkan variabel dependen berupa label prestasi (berprestasi atau tidak berprestasi). Tahap preprocessing meliputi normalisasi label, seleksi fitur, serta imputasi median untuk menangani data yang hilang. Dataset dibagi menjadi 75% data latih dan 25%. Model diimplementasikan dalam bentuk pipeline yang terdiri atas median imputer dan Gaussian Naive Bayes classifier. Hasil evaluasi menunjukkan bahwa model mencapai akurasi sebesar 79,2%, dengan nilai recall sempurna (1,00) pada kelas berprestasi dan lebih rendah (0,64) pada kelas tidak berprestasi. Hal ini menunjukkan bahwa model cukup efektif dalam mengidentifikasi siswa berprestasi. Model yang telah dilatih kemudian diintegrasikan ke dalam aplikasi web berbasis Flask, yang memungkinkan prediksi secara daring melalui antarmuka formulir sederhana untuk mendukung interpretasi kontekstual. Sistem ini diharapkan dapat membantu untuk pengambilan keputusan dalam pendidikan dengan membantu guru mengidentifikasi tingkat prestasi siswa sejak dini dan merancang intervensi pembelajaran yang lebih terarah.
Kata kunci: prestasi akademik; penambangan data Pendidikan; naive bayes; sistem prediksi; prestasi siswa