Abstract:Abstract: Data Mining is a term used to describe the processes in each itemset to be able to find the results of each item. Analysis is used to determine the promotion of electronic products, namely the a priori algorithm…
m association rules, therefore UD Surya Elektronik Shop for increasing sales results must have other strategies to be able to improve the sales system. One way is to determine the goods to be promoted to consumers. The collection of sales data that is owned can actually be processed using data mining to see customer buying patterns, with data mining for large data it will not be wasted and can be useful so that it can provide benefits to the company. In this study, the data processing uses the Apriori Algorithm, which is a data mining method that aims to find association patterns based on purchasing patterns made by consumers, so that it can be seen which items are often purchased simultaneously.
Kata Kunci : Data Mining, Apriori Algorithms, Product Promotion
Abstrak: Data Mining adalah suatu istilah yang digunakan untuk menguraikan proses-proses di setiap itemset untuk dapat menemukan hasil setiap item-item nya, Analisa yang digunakan untuk menentukan promosi produk-produk elektronik yaitu dengan aturan asosiasi algoritma apriori, oleh karena itu Toko UD Surya Elektronik untuk meningkatkan hasil penjualan maka harus memiliki strategi lain untuk dapat meningkatkan sistem penjualannya. Salah satunya adalah dengan menentukan barang yang akan dipromosikan kepada konsumen. Kumpulan data penjualan yang dimiliki sebenarnya dapat diolah menggunakan data mining untuk melihat pola pembelian pelanggan, dengan data mining untuk data yang besar tidak akan terbuang begitu saja dan dapat bermanfaat sehingga dapat memberikan keuntungan kepada perusahaan. Pada penelitian ini, proses pengolahan data menggunakan Algoritma Apriori yang merupakan salah satu metode data mining yang bertujuan untuk mencari pola assosiasi berdasarkan pola pembelian yang dilakukan oleh konsumen, sehingga bisa diketahui item-item barang apa saja yang sering dibeli secara bersamaan.
Kata Kunci : Data Mining, Algoritma Apriori, Promosi Produk.
Abstract:Abstract:Theft is the illegal taking of property or belongings of another person without the permission of the owner. The most common crime problem in Asahan District is theft, so that the POLRES is still having trouble…
determining which areas are often the crime of theft. With this problem, we need to do a grouping for areas where theft often occurs, so the process used is the data mining process. Data mining is one of the processes of Knowledge Discovery from Databases (KDD). KDD is an activity that includes collecting, using historical data to find regularities, patterns or relationships in large data sets. One of the techniques known in data mining is clustering technique. The K-Means method is a method for clustering techniques, K- Means is a method that partitions data into groups so that data with the same characteristics are entered into the same set of groups and data with different characteristics are grouped into other groups. The attributes used in grouping this data are annual data, namely 2015, 2016, 2017, 2018, 2019. A case study of 9 POLSEK in the Asahan.
Keywords: Data Mining, Clustering, K-Means Algorithm, Theft Crimes Grouping.
Abstrak: Pencurian merupakan pengambilan properti atau barang milik orang lain secara tidak sah tanpa ijin dari pemilik. Masalah tindak kejahatan yang paling banyak terjadi di Kabupaten Asahan adalah tindak kejahatan pencurian sehingga pihak POLRES masih kesulitan untuk menentukan daerah mana saja yang sering terjadi tindak kejahatan pencuriaan. Dengan adanya masalah ini kita perlu melakukan pengelompokan untuk daerah mana saja yang sering terjadi tindak pencurian maka proses yang digunakan adalah proses data mining. Data mining adalah salah satu proses dari Knowledge Discovery from Databases (KDD). KDD adalah kegiatan yang meliputi pengumpulan, pemakaian data, historis untuk menemukan keteraturan, pola atau hubungan dalam set data besar. Salah satu teknik yang di kenal dalam data mining adalah teknik clustering. Metode K-Means merupakan metode untuk teknik clustering, K-Means adalah metode yang mempartisi data kedalam kelompok sehingga data berkarakteristik sama dimasukan kedalam set kelompok yang sama dan data yang berkerakteristik berbeda dikelompokkan ke dalam kelompok yang lain. Atribut yang di gunakan dalam pengelomokan data ini adalah data pertahun yaitu tahun 2015, 2016, 2017, 2018, 2019. Studi kasus pada 9 POLSEK yang ada di daerah kabupaten Asahan.
Kata kunci: Data Mining, Clustering, Algoritma K-Means, Pengelompokan Tindak Kejahatan Pencurian.
Abstract:The implementation of YOLOv4 technology in the image-processing-based learning system at SMK Negeri 2 Tanjungbalai aims to enhance students' understanding of various electronic components in the Audio-Video Engineering field.…
ield. Currently, the learning process is still conducted manually, where teachers bring components such as resistors, capacitors, and other electronic parts. This method presents challenges in teaching the names of electronic components, as manual learning requires more time and students must recognize each component physically, one by one. Furthermore, students need to process resistor color codes and IC markings, which demand significant time and understanding. The YOLOv4 algorithm, known for its efficiency and accuracy, is utilized to detect and identify the type and value of components such as resistors, capacitors, transistors, and ICs automatically. This community service activity includes training, workshops, and the implementation of an image-processing-based application designed to assist students in a more interactive and efficient learning process. The results of this initiative indicate that the use of this technology positively impacts students' comprehension and improves the effectiveness of learning media in the school laboratory.
Keywords: YOLOv4; image processing; electronic components; learning media
Abstrak: Penerapan teknologi YOLOv4 dalam sistem pembelajaran berbasis image processing di SMK Negeri 2 Tanjungbalai bertujuan untuk meningkatkan pemahaman siswa dalam mengenali berbagai komponen elektronika di bidang Teknik Audio Video. Media pembelajaran yang dilakukan saat ini masih menggunakan secara manual dengan cara guru membeawa komponen seperti resistor, kapasitor dan komponen lainnya. Dengan cara ini terdapat masalah dalam media pembelajaran untuk pengenalan nama nama komponen elektronika. Masalah yang terjadi pembelajaran manual membutuhkan waktu yang lebih lama dan siswa harus mengenali satu per satu nama nama komponen secara fisik. Selanjutnya siswa membutuhkan proses membaca kode warna resistor marking IC membutuhkan waktu dan pemahaman yang sangat lama. Algoritma YOLOv4 yang dikenal efisien dan akurat digunakan untuk mendeteksi serta mengidentifikasi jenis dan nilai komponen seperti resistor, kapasitor, transistor, dan IC secara otomatis. Kegiatan pengabdian ini mencakup pelatihan, workshop, serta implementasi aplikasi berbasis image processing yang dirancang untuk membantu siswa dalam proses pembelajaran yang lebih interaktif dan efisien. Hasil kegiatan menunjukkan bahwa penggunaan teknologi ini memberikan dampak positif terhadap pemahaman siswa serta meningkatkan efektivitas media pembelajaran di laboratorium sekolah.
Kata kunci: YOLOv4; image processing; komponen elektronika; media pembelajaran
Abstract:Abstract: The advancement of smart agriculture has become a promising solution to increase food productivity and land use efficiency in urban environments. This research aims to develop an Artificial Intelligence (AI)-based…
sed vertical hydroponic farming system integrated with LED grow light technology and catfish aquaponics. The proposed system combines vertical hydroponics and aquaponics to optimize plant growth and water utilization. Internet of Things technology enables real-time environmental monitoring through an Arduino Uno microcontroller integrated with LDR, soil moisture, pH, and NPK sensors. The obtained sensor data is processed using the Mamdani Fuzzy Logic algorithm, which performs fuzzification, rule inference, aggregation, and defuzzification to generate adaptive control decisions for irrigation, nutrient circulation, and LED grow light intensity. This research uses the Research and Development (R&D) method through prototype development and performance evaluation for 30 days using spinach (Amaranthus spp.) and mustard greens (Brassica juncea) as test plants. Experimental results showed that the developed system successfully maintained stable environmental conditions, with soil moisture ranging between 69–72%, a pH value between 6.4 and 6.6, and optimal nutrient availability. Plant growth increased significantly. The integration of IoT, AI and aquaponics improves cultivation efficiency, enabling environmental control as a smart and sustainable solution for urban agriculture.
Keywords: artificial intelligence; aquaponic; hydroponic; LED grow light; vertical farming
Abstract: Kemajuan pertanian cerdas telah menjadi solusi yang menjanjikan untuk meningkatkan produktivitas pangan dan efisiensi penggunaan lahan di lingkungan perkotaan. Penelitian ini bertujuan untuk mengembangkan sistem pertanian hidroponik vertikal berbasis Kecerdasan Buatan (AI) yang terintegrasi dengan teknologi lampu tumbuh LED dan aquaponik ikan lele. Sistem yang diusulkan menggabungkan hidroponik vertikal dan aquaponik untuk mengoptimalkan pertumbuhan tanaman dan pemanfaatan air. Teknologi Internet of Things memungkinkan pemantauan lingkungan secara real-time melalui mikrokontroler arduino uno yang terintegrasi dengan sensor LDR, kelembaban tanah, pH, dan NPK. Data sensor yang diperoleh diproses menggunakan algoritma Logika Fuzzy Mamdani, yang melakukan fuzzifikasi, inferensi aturan, agregasi, dan defuzzifikasi untuk menghasilkan keputusan kontrol adaptif untuk irigasi, sirkulasi nutrisi, dan intensitas lampu tumbuh LED. Penelitian ini menggunakan metode Pengembangan (R&D) melalui pengembangan prototipe dan evaluasi kinerja selama 30 hari menggunakan bayam (Amaranthus spp.) dan sawi hijau (Brassica juncea) sebagai tanaman uji. Hasil eksperimen menunjukkan bahwa sistem yang dikembangkan berhasil mempertahankan kondisi lingkungan yang stabil, dengan kelembaban tanah berkisar antara 69–72%, nilai pH antara 6,4 dan 6,6, dan ketersediaan nutrisi yang optimal. Pertumbuhan tanaman meningkat secara signifikan. Integrasi IoT, AI dan aquaponik meningkatkan efisiensi budidaya, untuk pengendalian lingkungan sebagai solusi cerdas dan berkelanjutan untuk pertanian perkotaan.
Keywords: aquaponik; kecerdasan buatan; hidroponik; lampu tumbuh LED; pertanian vertikal
Abstract:Abstract: Student graduation is an urgent matter that is an indicator of the success of a university in producing its learning output. Several factors influence student graduation such as GPA, attendance, late taking credits,…
dits, and lack of student involvement in academic activities. The urgency of this research, universities need a method that is able to predict student graduation early so that it can provide academic intervention to students who have the potential to experience delays or fail to graduate. However, limited access to real academic data is often an obstacle in the development of predictive models, Therefore, this study aims to implement the XGBoost algorithm to predict student graduation based on several academic variables, namely the Cumulative Grade Point Average (GPA), the number of credits taken, the percentage of attendance, and the average grade of students. Model training using the XGBoost algorithm using a simulation dataset of 500 students who are labeled as graduating into two classes, namely passed and failed. The results of the study showed that the classification performance was very good with an accuracy value of 99.6%, Precision 99.7%, recall 99.4%.
Keywords: xgboost algorithm; data mining; student graduation
Abstrak: Kelulusan mahasiswa merupakan hal urgensi yang menjadi indikator keberhasilan sebuah perguruan tinggi dalam menghasilkan output pembelajarannya. Beberapa Faktor yang mempengaruhi kelulusan mahasiswa seperti IPK, kehadiran, keterlambatan pengambilan SKS, serta kurangnya keterlibatan mahasiswa dalam aktifitas akademik. Yang menjadi urgensi penelitian ini, Perguruan tinggi memerlukan suatu metode yang mampu memprediksi kelulusan mahasiswa secara dini sehingga dapat memberikan intervensi akademik kepada mahasiswa yang berpotensi mengalami keterlambatan atau tidak lulus. Namun, keterbatasan akses terhadap data akademik riil sering menjadi kendala dalam pengembangan model prediksi, Oleh karena itu, penelitian ini bertujuan mengimplementasikan algoritma XGBoost untuk memprediksi kelulusan mahasiswa berdasarkan beberapa variabel akademik, yaitu Indeks Prestasi Kumulatif (IPK), jumlah SKS yang ditempuh, persentase kehadiran, dan nilai rata-rata mahasiswa. Pelatihan model menggunakan algoritma XGBoost dengan menggunakan dataset simulasi 500 mahasiswa yang diberi label kelulusan menjadi dua kelas yaitu lulus dan tidak lulus. Hasil penelitian menunjukan bahwa performance klasifikasi yang sangat baik dengan nilai accurasi sebesar 99,6%, Precision 99,7%, recall 99,4%.
Kata kunci: algoritma xgbosst; kelulusan mahasiswa; penambangan data
Abstract:Abstract: The advancement of digital technology has made it easier to create, process, and distribute files—using 317 files from the dataset https://www.kaggle.com/datasets/axon data/selfie-and-official-id-photo-dataset-18k…
t-18k images?select=metadata_image.csv has also introduced new challenges, such as the increasing practice of digital file manipulation that is difficult to detect visually. Therefore, an intelligent digital forensics system that can automatically and accurately detect file authenticity is required. This study aims to develop an intelligent digital forensics system for detecting file manipulation by leveraging metadata analysis and the Random Forest classification method. The methods used include extracting metadata from digital files—such as time information, device details, and processing history—followed by analysis to identify patterns of inconsistency that indicate manipulation. This data is then used as features in the classification process using the Random Forest algorithm to distinguish between original and manipulated files. The results of this study are expected to show that the use of metadata analysis combined with the Random Forest algorithm can improve accuracy in detecting digital file manipulation compared to conventional methods. The resulting system is expected to provide an effective, efficient, and integrated solution to support digital forensic investigations, Based on the test results, the system demonstrated good performance with an accuracy rate of 94%.
Keywords: Digital Forensics;File Manipulation;Metadata Analysis;Random Forest;Classification;Machine Learning
Abstrak:Perkembangan teknologi digital telah meningkatkan kemudahan dalam pembuatan, pengolahan,dan distribusi file sebanyak 317 file, sumber datasets https:// www.kaggle.com/datasets/axondata/selfie-and-official-id-photo-dataset-18k-images?select =metadata_image.csv, namun juga menimbulkan tantangan baru berupa meningkatnya praktik manipulasi file digital yang sulit dideteksi secara kasat mata. Oleh karena itu, diperlukan suatu sistem forensik digital yang cerdas dan mampu mendeteksi keaslian file secara otomatis dan akurat. Penelitian ini bertujuan untuk mengembangkan sistem forensik digital cerdas untuk deteksi manipulasi file dengan memanfaatkan analisis metadata dan metode klasifikasi Random Forest. Metode yang digunakan meliputi proses ekstraksi metadata dari file digital, seperti informasi waktu, perangkat, dan riwayat pengolahan, kemudian dilakukan analisis untuk menemukan pola ketidaksesuaian yang mengindikasikan adanya manipulasi. Selanjutnya, data tersebut digunakan sebagai fitur dalam proses klasifikasi menggunakan algoritma Random Forest untuk membedakan antara file asli dan file yang telah dimanipulasi. Hasil dari penelitian ini diharapkan menunjukkan bahwa penggunaan analisis metadata yang dikombinasikan dengan algoritma Random Forest mampu meningkatkan akurasi dalam mendeteksi manipulasi file digital dibandingkan metode konvensional. Sistem yang dihasilkan dapat memberikan solusi yang efektif, efisien, dan terintegrasi dalam mendukung proses investigasi forensik digital, Berdasarkan hasil pengujian, sistem menunjukkan performa yang baik dengan tingkat akurasi sebesar 94%.
Kata Kunci: Forensik Digital, Manipulasi File, Metadata, Random Forest, Klasifikasi, Machine Learning.
Abstract:Abstract: The rapid growth of e-commerce mobile applications has generated large volumes of user reviews, making manual sentiment analysis increasingly impractical. This study aims to compare the effectiveness of three machine…
achine learning algorithms Support Vector Machine (SVM), Random Forest, and Naive Bayes for automated sentiment classification of Indonesian-language mobile application reviews. A dataset of 3,000 user reviews from the RupaRupa application on the Google Play Store was collected and preprocessed through normalization, tokenization, stopword removal, and stemming. TF-IDF vectorization was applied for feature extraction, while the Synthetic Minority Over-sampling Technique (SMOTE) was used to address class imbalance across three sentiment categories: positive, negative, and neutral. The results show that SVM achieved the highest accuracy of 90.02%, while Random Forest obtained the best F1-score of 88.08% when sufficient training data were available. Naive Bayes demonstrated relatively stable performance across varying training data sizes. Furthermore, TF-IDF keyword analysis revealed that negative reviews were primarily associated with delivery issues, technical problems, and pricing concerns. These findings demonstrate the effectiveness of machine learning approaches for sentiment classification and provide practical insights for improving mobile application services.
Keywords: sentiment analysis; machine learning; SMOTE; TF-IDF; text classification
Abstrak: Pertumbuhan pesat aplikasi mobile e-commerce telah menghasilkan volume ulasan pengguna yang sangat besar, sehingga analisis sentimen secara manual menjadi semakin tidak praktis. Penelitian ini bertujuan untuk membandingkan efektivitas tiga algoritma machine learning Support Vector Machine (SVM), Random Forest, dan Naive Bayes dalam melakukan klasifikasi sentimen otomatis terhadap ulasan aplikasi mobile berbahasa Indonesia. Dataset yang digunakan terdiri dari 3.000 ulasan pengguna aplikasi RupaRupa yang dikumpulkan dari Google Play Store. Data kemudian diproses melalui tahapan preprocessing yang meliputi normalisasi, tokenisasi, penghapusan stopword, dan stemming. Ekstraksi fitur dilakukan menggunakan metode Term Frequency–Inverse Document Frequency (TF-IDF), sedangkan ketidakseimbangan kelas ditangani menggunakan Synthetic Minority Over-sampling Technique (SMOTE) pada tiga kategori sentimen, yaitu positif, negatif, dan netral. Hasil penelitian menunjukkan bahwa SVM mencapai tingkat akurasi tertinggi sebesar 90,02%, sementara Random Forest memperoleh nilai F1-score terbaik sebesar 88,08% ketika tersedia data pelatihan yang memadai. Naive Bayes menunjukkan performa yang relatif stabil pada berbagai ukuran data pelatihan. Selain itu, analisis kata kunci berbasis TF-IDF mengungkapkan bahwa ulasan negatif terutama berkaitan dengan masalah pengiriman, kendala teknis aplikasi, dan isu harga. Temuan ini menunjukkan bahwa pendekatan machine learning efektif untuk klasifikasi sentimen serta memberikan wawasan yang bermanfaat dalam meningkatkan kualitas layanan aplikasi mobile.
Kata Kunci: analisis sentimen; pembelajaran mesin; SMOTE; TF-IDF; klasifikasi teks.
Abstract:Abstract: Mental health issues, particularly depression among young adult university students, are often detected late due to stigma and reluctance to seek medical consultation. The objective of this study is to develop…
an early screening model employing machine learning techniques, specifically the random forest algorithm, on a dataset of 268 students (aged 17-29 years; consisting of 98 males and 170 females) within a multicultural educational setting. The principal challenges associated with this dataset are class imbalance and the potential for data leakage from clinical scores. This study implements a rigorous feature selection approach that involves the elimination of depression score features and the utilization of the Synthetic Minority Over-sampling Technique (SMOTE) to balance the training data distribution. Furthermore, a Threshold Tuning strategy is employed to prioritize detection sensitivity (Recall). The findings indicate that reducing the decision threshold to an optimal value of 0.25 led to a substantial enhancement in the recall value, increasing it from 36% (baseline) to 77%. A feature importance analysis was conducted, the results of which indicated that Total Social Connectedness (ToSC) is the most dominant predictor. In summary, the present study corroborates the notion that optimizing sensitivity through threshold tuning is of paramount importance for medical screening. Furthermore, social isolation factors emerge as more significant indicators of depression risk than demographic attributes.
Keywords: data mining; depression; imbalanced data; random forest; smote; threshold tuning
Abstrak: Masalah kesehatan mental, khususnya depresi di kalangan mahasiswa dewasa muda, sering terdeteksi terlambat akibat stigma dan enggan mencari konsultasi medis. Tujuan studi ini adalah mengembangkan model skrining dini menggunakan teknik machine learning, khususnya algoritma random forest, pada dataset 268 mahasiswa (usia 17-29 tahun; terdiri dari 98 laki-laki dan 170 perempuan) dalam lingkungan pendidikan multikultural. Tantangan utama yang terkait dengan dataset ini adalah ketidakseimbangan kelas dan potensi kebocoran data dari skor klinis. Studi ini menerapkan pendekatan seleksi fitur yang ketat, yang melibatkan eliminasi fitur skor depresi dan penggunaan Teknik Over-sampling Minoritas Sintetis (SMOTE) untuk menyeimbangkan distribusi data pelatihan. Selain itu, strategi Penyesuaian Ambang Batas diterapkan untuk memprioritaskan sensitivitas deteksi (Recall). Hasil penelitian menunjukkan bahwa mengurangi ambang batas keputusan ke nilai optimal 0,25 menyebabkan peningkatan signifikan dalam nilai recall, dari 36% (dasar) menjadi 77%. Analisis pentingnya fitur dilakukan, hasilnya menunjukkan bahwa Total Social Connectedness (ToSC) adalah prediktor yang paling dominan. Secara ringkas, studi ini membenarkan bahwa mengoptimalkan sensitivitas melalui penyesuaian ambang batas sangat penting untuk skrining medis. Selain itu, faktor isolasi sosial muncul sebagai indikator risiko depresi yang lebih signifikan daripada atribut demografis.
Kata kunci: penambangan data; depresi; data tidak seimbang; hutan acak; smote; penyesuaian ambang batas
Abstract:Abstract: Rehabilitation programs are essential in correctional systems to equip inmates with the skills and behavioral readiness required for social reintegration. However, rehabilitation program assignment in many correctional…
ectional institutions remains dependent on manual and subjective assessments, which may result in inconsistent decisions. This study develops a Random Forest–based prediction system to support objective and data-driven rehabilitation program determination. A quantitative approach was applied using historical inmate data from January 2023 to January 2025, comprising 2,023 records. The research process included data preprocessing, an 80:20 training–testing split, model training, and performance evaluation using accuracy, precision, recall, and F1-score metrics. The results show that the model achieved an accuracy of 86.17% during training in Google Colab and 68.83% when deployed within the application system. This performance gap reflects real-world deployment and computational constraints rather than model failure. The proposed system provides consistent and objective rehabilitation program recommendations, thereby supporting more effective rehabilitation planning and decision-making in correctional institutions.
Keywords: correctional institutions; inmate rehabilitation programs; machine learning; random Forest; prediction system
Abstrak: Program pembinaan narapidana memiliki peran penting dalam sistem pemasyarakatan untuk membekali warga binaan dengan keterampilan serta kesiapan perilaku dalam proses reintegrasi ke masyarakat. Namun, pada banyak lembaga pemasyarakatan, penentuan program pembinaan masih bergantung pada penilaian manual yang bersifat subjektif, sehingga berpotensi menimbulkan ketidakkonsistenan dalam pengambilan keputusan. Penelitian ini mengembangkan sistem prediksi program pembinaan narapidana berbasis algoritma Random Forest guna mendukung pengambilan keputusan yang objektif dan berbasis data. Pendekatan kuantitatif diterapkan menggunakan data historis narapidana periode Januari 2023 hingga Januari 2025 sebanyak 2.023 data. Tahapan penelitian meliputi prapemrosesan data, pembagian data latih dan uji dengan rasio 80:20, pelatihan model, serta evaluasi performa menggunakan metrik akurasi, precision, recall, dan F1-score. Hasil penelitian menunjukkan bahwa model mencapai akurasi sebesar 86,17% pada tahap pelatihan di Google Colab dan 68,83% saat diimplementasikan pada sistem aplikasi. Perbedaan performa tersebut mencerminkan keterbatasan lingkungan operasional, bukan kegagalan model. Secara keseluruhan, sistem yang dikembangkan mampu memberikan rekomendasi program pembinaan yang lebih objektif dan konsisten, sehingga mendukung perencanaan pembinaan yang lebih efektif.
Kata kunci: mesin pembelajaran; program pembinaan narapidana; random Forest; sistem pemasyarakatan; sistem prediksi
Abstract:Abstract: Academic achievement mapping is an important process in higher education to support effective academic monitoring and guidance. In practice, student grouping is often conducted manually by academic staff using…
simple criteria such as Grade Point Average (GPA) thresholds and subjective judgment, without systematic data analysis. This study aims to apply the Fuzzy C-Means (FCM) clustering algorithm to objectively group students based on their academic achievement levels. The dataset consists of academic records from 179 sixth-semester students of the Computer Science Study Program at Universitas Islam Negeri Sumatera Utara, where 160 eligible students are processed in the FCM calculation. Three variables are used: cumulative GPA, total completed credits, and the total number of low grades (D/E). The FCM algorithm automatically performs the mapping and groups students into three categories, namely excellent, stable, and at-risk students. Cluster quality is evaluated using the Silhouette Score and Davies–Bouldin Index, showing satisfactory clustering performance. The results indicate that the proposed approach provides a data-driven and objective basis for academic decision support.
Keywords: academic achievement; clustering; fuzzy c-means; student
Abstrak: Pemetaan pencapaian akademik mahasiswa merupakan proses penting dalam pendidikan tinggi untuk mendukung pemantauan dan pembinaan akademik yang tepat sasaran. Dalam praktiknya, pengelompokan mahasiswa masih sering dilakukan secara manual oleh pihak akademik berdasarkan kriteria sederhana, seperti batasan Indeks Prestasi Kumulatif (IPK) dan penilaian subjektif, tanpa analisis data yang sistematis. Penelitian ini bertujuan menerapkan algoritma Fuzzy C-Means (FCM) untuk mengelompokkan mahasiswa secara objektif berdasarkan tingkat pencapaian akademik. Data penelitian berasal dari 179 mahasiswa semester enam Program Studi Ilmu Komputer Universitas Islam Negeri Sumatera Utara, dengan 160 mahasiswa memenuhi kriteria dan diproses menggunakan algoritma FCM. Variabel yang digunakan meliputi IPK kumulatif, jumlah SKS yang telah ditempuh, dan total nilai rendah (D/E). Proses pemetaan sepenuhnya dilakukan oleh algoritma FCM dan menghasilkan tiga kategori mahasiswa, yaitu unggul, stabil, dan berisiko. Evaluasi menggunakan Silhouette Score dan Davies–Bouldin Index menunjukkan kualitas pengelompokan yang cukup baik.
Kata kunci: fuzzy c-means; clustering; mahasiswa; pencapaian akademik