Abstract:Abstract: Student graduation is an urgent matter that is an indicator of the success of a university in producing its learning output. Several factors influence student graduation such as GPA, attendance, late taking credits,…
dits, and lack of student involvement in academic activities. The urgency of this research, universities need a method that is able to predict student graduation early so that it can provide academic intervention to students who have the potential to experience delays or fail to graduate. However, limited access to real academic data is often an obstacle in the development of predictive models, Therefore, this study aims to implement the XGBoost algorithm to predict student graduation based on several academic variables, namely the Cumulative Grade Point Average (GPA), the number of credits taken, the percentage of attendance, and the average grade of students. Model training using the XGBoost algorithm using a simulation dataset of 500 students who are labeled as graduating into two classes, namely passed and failed. The results of the study showed that the classification performance was very good with an accuracy value of 99.6%, Precision 99.7%, recall 99.4%.
Keywords: xgboost algorithm; data mining; student graduation
Abstrak: Kelulusan mahasiswa merupakan hal urgensi yang menjadi indikator keberhasilan sebuah perguruan tinggi dalam menghasilkan output pembelajarannya. Beberapa Faktor yang mempengaruhi kelulusan mahasiswa seperti IPK, kehadiran, keterlambatan pengambilan SKS, serta kurangnya keterlibatan mahasiswa dalam aktifitas akademik. Yang menjadi urgensi penelitian ini, Perguruan tinggi memerlukan suatu metode yang mampu memprediksi kelulusan mahasiswa secara dini sehingga dapat memberikan intervensi akademik kepada mahasiswa yang berpotensi mengalami keterlambatan atau tidak lulus. Namun, keterbatasan akses terhadap data akademik riil sering menjadi kendala dalam pengembangan model prediksi, Oleh karena itu, penelitian ini bertujuan mengimplementasikan algoritma XGBoost untuk memprediksi kelulusan mahasiswa berdasarkan beberapa variabel akademik, yaitu Indeks Prestasi Kumulatif (IPK), jumlah SKS yang ditempuh, persentase kehadiran, dan nilai rata-rata mahasiswa. Pelatihan model menggunakan algoritma XGBoost dengan menggunakan dataset simulasi 500 mahasiswa yang diberi label kelulusan menjadi dua kelas yaitu lulus dan tidak lulus. Hasil penelitian menunjukan bahwa performance klasifikasi yang sangat baik dengan nilai accurasi sebesar 99,6%, Precision 99,7%, recall 99,4%.
Kata kunci: algoritma xgbosst; kelulusan mahasiswa; penambangan data
Abstract:Abstract: The development of information technology has begun to enter the world of education, especially universities, one of which is the academic information system because with this system it greatly influences the learning…
earning process and also in the delivery of information. A web-based academic information system is very adequate, but there are several obstacles such as in learning that does not require a laptop device, it will be very disruptive if the implementation of attendance and others is done on a mobile phone but with a web view. So this research aims to design a mobile-based UI/UX academic information system application with the hope that it can be an alternative in accessing the use of academic information systems for lecturers and students can also be accessed anytime and anywhere through mobile phones with a comfortable display. This study also tested the UI/UX design prototype to assess its feasibility. This test uses the system usability scale (SUS) method with a convident interval validation of 95% to determine the lower and upper limits of the SUS value. For the final score of SUS obtained was 78.75, and in the 95% CI test a Lower CI of 66.27 was produced, and for the Upper CI of 91.23 so that it was given a grade of B. It can be concluded that the design developed in this study is worthy of further development.
Keywords: academic information systems; design thinking; system usability scale
Abstrak: Perkembangan teknologi informasi sudah mulai masuk kedalam dunia pendidikan terutama perguruan tinggi, salah satunya sistem informasi akademik karena dengan adanya sistem ini sangat mempengarusi proses pembelajaran dan juga dalam penyampaian informasi. Sistem informasi akademik berbasis web sudah sangat memadai namun ada beberapa kendala seperti dalam pembelajaran yang tidak memerlukan perangkat laptop akan sangat menganggu jika pelaksanaan absensi dan lainya dilakukan pada ponsel tapi dengan tampilan web. Sehingga penelitian ini bertujuan untuk merancang UI/UX aplikasi sistem informasi akademik berbasis mobile dengan harapan dapat menjadi alternatif dalam akses penggunaan sistem informasi akademik bagi dosen dan mahasiswa juga dapat diakses kapan saja dan dimana saja melalui ponsel dengan tampilan yang nyaman. Penelitian ini juga melakukan pengujian terhadap prototype desain UI/UX untuk menilai kelayakannya. Pengujian ini menggunaka metode system usability scale (SUS) dengan validasi convident interval 95% untuk mengetahui batas bawah dan batas atas nilai SUS. Untuk nilai akhir SUS yang didapatkan adalah 78,75, dan dalam pengujian CI 95 % dihasilkan CI Lower 66,27, dan untuk CI Upper 91,23 Sehingga mendapat grade B. Dapat disumpulkan bahwa desain yang dikembangkan dalam penelitian ini layak untuk dikembangkan lebih lanjut.
Kata kunci: sistem informasi akademik; desain thinking; system usability scale
Abstract:Abstract: The rapid growth of e-commerce mobile applications has generated large volumes of user reviews, making manual sentiment analysis increasingly impractical. This study aims to compare the effectiveness of three machine…
achine learning algorithms Support Vector Machine (SVM), Random Forest, and Naive Bayes for automated sentiment classification of Indonesian-language mobile application reviews. A dataset of 3,000 user reviews from the RupaRupa application on the Google Play Store was collected and preprocessed through normalization, tokenization, stopword removal, and stemming. TF-IDF vectorization was applied for feature extraction, while the Synthetic Minority Over-sampling Technique (SMOTE) was used to address class imbalance across three sentiment categories: positive, negative, and neutral. The results show that SVM achieved the highest accuracy of 90.02%, while Random Forest obtained the best F1-score of 88.08% when sufficient training data were available. Naive Bayes demonstrated relatively stable performance across varying training data sizes. Furthermore, TF-IDF keyword analysis revealed that negative reviews were primarily associated with delivery issues, technical problems, and pricing concerns. These findings demonstrate the effectiveness of machine learning approaches for sentiment classification and provide practical insights for improving mobile application services.
Keywords: sentiment analysis; machine learning; SMOTE; TF-IDF; text classification
Abstrak: Pertumbuhan pesat aplikasi mobile e-commerce telah menghasilkan volume ulasan pengguna yang sangat besar, sehingga analisis sentimen secara manual menjadi semakin tidak praktis. Penelitian ini bertujuan untuk membandingkan efektivitas tiga algoritma machine learning Support Vector Machine (SVM), Random Forest, dan Naive Bayes dalam melakukan klasifikasi sentimen otomatis terhadap ulasan aplikasi mobile berbahasa Indonesia. Dataset yang digunakan terdiri dari 3.000 ulasan pengguna aplikasi RupaRupa yang dikumpulkan dari Google Play Store. Data kemudian diproses melalui tahapan preprocessing yang meliputi normalisasi, tokenisasi, penghapusan stopword, dan stemming. Ekstraksi fitur dilakukan menggunakan metode Term Frequency–Inverse Document Frequency (TF-IDF), sedangkan ketidakseimbangan kelas ditangani menggunakan Synthetic Minority Over-sampling Technique (SMOTE) pada tiga kategori sentimen, yaitu positif, negatif, dan netral. Hasil penelitian menunjukkan bahwa SVM mencapai tingkat akurasi tertinggi sebesar 90,02%, sementara Random Forest memperoleh nilai F1-score terbaik sebesar 88,08% ketika tersedia data pelatihan yang memadai. Naive Bayes menunjukkan performa yang relatif stabil pada berbagai ukuran data pelatihan. Selain itu, analisis kata kunci berbasis TF-IDF mengungkapkan bahwa ulasan negatif terutama berkaitan dengan masalah pengiriman, kendala teknis aplikasi, dan isu harga. Temuan ini menunjukkan bahwa pendekatan machine learning efektif untuk klasifikasi sentimen serta memberikan wawasan yang bermanfaat dalam meningkatkan kualitas layanan aplikasi mobile.
Kata Kunci: analisis sentimen; pembelajaran mesin; SMOTE; TF-IDF; klasifikasi teks.
Abstract:Abstract: Accurate forecasts of tea harvest production are important for workforce planning, factory operations, and marketing decisions, yet conventional estimation in plantations often relies on field experience and can…
n be biased and less adaptive to changing conditions. This study aims to develop a Random Forest Regression model to predict tea harvest production at the Bah Butong tea plantation using historical operational and climate-related data. The dataset consists of 60 monthly records (2020–2024) with six predictor variables: rainfall (mm), number of rainy days, pest level, weed level, number of harvested trees and land area. Data were split into 80% training (48 samples) and 20% testing (12 samples). Model hyperparameters were optimized using RandomizedSearchCV with RepeatedKFold cross-validation (5 folds, 3 repeats). The tuned model achieved MSE of 668,980,524.45, RMSE of 25,864.66 kg, MAE of 19,838.69 kg, and MAPE of 7.59% on the test set. The results indicate that the model can provide practical production estimates, with errors averaging about 7–8% of the actual production. Feature importance analysis shows that the number of harvested tea bushes and cultivated area contribute most to predictions. Future work should extend the historical period and incorporate time-based features (seasonality/lag) for improved forecasting.
Keywords: hyperparameter tuning; production prediction; random forest; regression; tea harvest
Abstrak: Perkiraan akurat produksi panen teh sangat penting untuk perencanaan tenaga kerja, operasional pabrik, dan keputusan pemasaran, namun estimasi konvensional di perkebunan seringkali bergantung pada pengalaman lapangan dan dapat bias serta kurang adaptif terhadap perubahan kondisi. Studi ini bertujuan untuk mengembangkan model Regresi Random Forest untuk memprediksi produksi panen teh di perkebunan teh Bah Butong menggunakan data operasional dan data terkait iklim historis. Dataset terdiri dari 60 catatan bulanan (2020–2024) dengan enam variabel prediktor: curah hujan (mm), jumlah hari hujan, tingkat hama, tingkat gulma, jumlah pokok panen, dan luas lahan. Data dibagi menjadi 80% data pelatihan (48 sampel) dan 20% data pengujian (12 sampel). Parameter model dioptimalkan menggunakan RandomizedSearchCV dengan validasi silang RepeatedKFold (5 lipatan, 3 pengulangan). Model yang telah disempurnakan mencapai MSE sebesar 668.980.524,45, RMSE sebesar 25.864,66 kg, MAE sebesar 19.838,69 kg, dan MAPE sebesar 7,59% pada set data uji. Hasil tersebut menunjukkan bahwa model dapat memberikan estimasi produksi yang praktis, dengan kesalahan rata-rata sekitar 7–8% dari produksi aktual. Analisis kepentingan fitur menunjukkan bahwa jumlah semak teh yang dipanen dan luas lahan budidaya paling berkontribusi pada prediksi. Pekerjaan selanjutnya harus memperpanjang periode historis dan menggabungkan fitur berbasis waktu (musiman/lag) untuk peramalan yang lebih baik.
Kata kunci: panen teh; prediksi produksi; random forest; regresi; tuning parameter
Abstract:Abstract: The development of globalization and digitalization requires businesses to not only focus on product quality, but also on the ability to build and maintain long-term relationships with customers. Customer loyalty…
ty has become a strategic asset that influences business sustainability and competitiveness. Handmade Willy, a creative business engaged in the production and sale of handicrafts, faces various problems in customer management, such as difficulties in identifying customer preferences, limitations in ongoing communication, suboptimal customer segmentation, and the absence of a structured system for monitoring customer satisfaction and feedback. These problems have an impact on the ineffectiveness of marketing strategies and the potential decline in customer loyalty. This study aims to optimize customer relationships at Handmade Willy through the application of the Customer Relationship Management (CRM) concept. The research method used is descriptive analysis with a qualitative approach through data collection from observation, interviews, and literature studies. The blackbox testing results show that the system runs smoothly without any obstacles. The implementation of CRM helps Handmade Willy understand customer characteristics and preferences, perform more accurate segmentation, improve communication effectiveness, and systematically monitor customer satisfaction.
Keyword: customer loyalty; customer relationship management; handmade willy.
Abstrak: Perkembangan era globalisasi dan digitalisasi menuntut pelaku usaha untuk tidak hanya berfokus pada kualitas produk, tetapi juga pada kemampuan membangun dan mempertahankan hubungan jangka panjang dengan pelanggan. Loyalitas pelanggan menjadi aset strategis yang berpengaruh terhadap keberlanjutan dan daya saing bisnis. Handmade Willy sebagai usaha kreatif yang bergerak di bidang produksi dan penjualan kerajinan tangan menghadapi berbagai permasalahan dalam pengelolaan pelanggan seperti kesulitan dalam mengidentifikasi preferensi pelanggan, keterbatasan komunikasi berkelanjutan, belum optimalnya segmentasi pelanggan serta belum adanya sistem yang terstruktur untuk memantau kepuasan dan umpan balik pelanggan. Permasalahan tersebut berdampak pada kurang efektifnya strategi pemasaran dan potensi penurunan loyalitas pelanggan. Penelitian ini bertujuan untuk mengoptimalkan hubungan pelanggan pada Handmade Willy melalui penerapan konsep Customer Relationship Management (CRM). Metode penelitian yang digunakan adalah analisis deskriptif dengan pendekatan kualitatif melalui pengumpulan data observasi, wawancara dan studi literatur. Hasil pengujian blackbox menunjukkan sistem yang dibuat berjalan dengan lancar tanpa ada kendala. Dengan penerapan CRM mampu membantu Handmade Willy dalam memahami karakteristik dan preferensi pelanggan, melakukan segmentasi yang lebih tepat, meningkatkan efektivitas komunikasi serta memantau kepuasan pelanggan secara sistematis.
Kata kunci: customer relationship management; kerajinan tangan willy; loyalitas pelanggan.
Abstract:Abstract: This research is motivated by the problem of building material inventory management at Jaqfar Building Store, which is still done manually and based on subjective estimates. This often results in inaccuracies in…
n determining stock levels, either in the form of overstock or understock, which hinders operational effectiveness. The purpose of this study is to apply the Multiple Linear Regression method to analyze the relationship between incoming stock (X1) and outgoing stock (X2) variables with the ending stock variable (Y) to produce an optimal inventory prediction model. The research methodology used includes collecting historical transaction data for building materials such as cement, ceramics, zinc, plywood, and iron. This web-based prediction system was developed using the PHP programming language and a MySQL database. The analysis results show that the resulting regression model can provide a mathematical picture of future inventory patterns based on historical data. Implementation of this system is expected to assist the management of Jaqfar Building Materials Store in making strategic decisions regarding purchasing and sales in a more measured and efficient manner.
Keyword: building materials; data mining; inventory; multiple linear regression
Abstrak: Penelitian ini dilatarbelakangi oleh permasalahan pengelolaan persediaan bahan bangunan di Toko Bangunan Jaqfar yang masih dilakukan secara manual dan berdasarkan perkiraan subjektif. Hal ini menyebabkan sering terjadinya ketidaktepatan dalam menentukan jumlah stok, baik berupa kelebihan barang (overstock) maupun kekurangan barang (understock) yang menghambat efektivitas operasional. Tujuan dari penelitian ini adalah menerapkan metode Multiple Linear Regression (Regresi Linear Berganda) untuk menganalisis hubungan antara variabel stok masuk (X1) dan stok keluar (X2) terhadap variabel stok akhir (Y) guna menghasilkan model prediksi persediaan yang optimal. Metodologi penelitian yang digunakan mencakup pengumpulan data historis transaksi bahan bangunan seperti semen, keramik, seng, triplek, dan besi. Sistem prediksi ini dikembangkan berbasis web menggunakan bahasa pemrograman PHP dan basis data MySQL. Hasil analisis menunjukkan bahwa model regresi yang dihasilkan mampu memberikan gambaran matematis mengenai pola persediaan di masa mendatang berdasarkan data historis. Implementasi sistem ini diharapkan dapat membantu manajemen Toko Bangunan Jaqfar dalam mengambil keputusan strategis terkait pembelian dan penjualan secara lebih terukur serta efisien.
Kata kunci: bahan bangunan; data mining; persediaan; regresi linear berganda
Abstract:Abstract: Storage media is an inseparable tool in everyday life. With storage media, users can store important data, both personal and workplace. In addition, in many cases, Indonesian law uses storage media as evidence.…
The Electronic Information and Transactions Law (UU ITE) regulates how the provision of digital evidence can be strong evidence in court. This study examines the forensics of digital evidence on storage media with four test scenarios. Digital forensic processing uses forensic processes based on the National Institute of Standards and Technology (NIST) guidelines. This study produces an analysis in which evidence processed with scenarios 1 and 4 is valid digital evidence to be submitted to court, while evidence 2 and 3 is invalid evidence. The results of this digital evidence can be used for investigations under the ITE law.
Keywords: autopssy; digital forensics; storage media; FTK Imager.
Abstrak: Media Penyimpanan merupakan alat yang tak terpisahkan dari kehidupan sehari-hari. Dengan Media Penyimpanan, pengguna dapat menyimpan data penting, baik pribadi maupun tempat kerja. Selain itu, dalam banyak kasus, hukum Indonesia menggunakan Media Penyimpanan sebagai alat bukti. Undang-Undang Informasi dan Transaksi Elektronik (UU ITE) mengatur bagaimana penyediaan alat bukti digital menjadi alat bukti yang kuat di pengadilan. Penelitian ini mengkaji forensik terhadap alat bukti digital pada Media Penyimpanan dengan empat skenario pengujian. Pemrosesan forensik digital menggunakan proses forensik berdasarkan panduan National Institute of Standards and Technology (NIST). Penelitian ini menghasilkan analisis di mana alat bukti yang diproses dengan skenario 1 dan 4 merupakan alat bukti digital yang sah untuk diajukan ke pengadilan, sedangkan alat bukti 2 dan 3 merupakan alat bukti yang tidak sah. Hasil dari barang bukti digital ini, dapat digunakan untuk penyelidikan didalam undang-undang ITE.
Kata kunci: otopsi; forensik digital; media penyimpanan; FTK Imager
Abstract:Abstract: The rapid development of digital technology has brought significant changes in consumption patterns and customer behavior, particularly in the fashion retail sector. Increasing competition and rising cynsumer expectations…
xpectations for fast, accurate, and technology-based services require businesses to innovate and undergo digital transformation. One widely used approach is the implementation of automation-based Electronic Customer Relationship Management (E-CRM). This study aims to analyze the implementation of E-CRM automation and its impact on service efficiency at Toko Diah Fashion, a fashion retail business that still faces service challenges due to manual systems, such as customer data duplication, delayed responses, and difficulty in monitoring transaction history. The research method used is a descriptive qualitative method with data collection techniques through observation, interviews, and documentation. The research focus is limited to aspects of service efficiency, including service speed, accuracy in managing customer data, and ease in customer follow-up. The E-CRM automation system studied is designed using PHP programming language and a MySQL database. The research results indicate that the implementation of E-CRM automation can significantly improve service efficiency. This system facilitates integrated customer data management, speeds up the service process, and supports more personalized communication through notification features and transaction history recording.
Keyword: automation; e-crm; fashion retail; service efficiency.
Abstrak: Perkembangan teknologi digital yang semakin pesat telah membawa perubahan signifikan dalam pola konsumsi dan perilaku pelanggan, khususnya dalam sektor ritel fashion. Persaingan yang semakin ketat serta meningkatnya ekspektasi konsumen terhadap layanan yang cepat, akurat dan berbasis teknologi menuntut pelaku usaha untuk melakukan inovasi dan transformasi digital. Salah satu pendekatan yang banyak digunakan adalah penerapan Electronic Customer Relationship Management (E-CRM) berbasis automasi. Penelitian ini bertujuan untuk menganalisis penerapan automasi E-CRM serta pengaruhnya terhadap efisiensi pelayanan pada Toko Diah Fashion, sebuah usaha ritel fashion yang masih menghadapi kendala pelayanan akibat sistem manual, seperti duplikasi data pelanggan, keterlambatan respons, dan kesulitan dalam pemantauan histori transaksi. Metode penelitian yang digunakan adalah metode kualitatif deskriptif dengan teknik pengumpulan data melalui observasi, wawancara, dan dokumentasi. Fokus penelitian dibatasi pada aspek efisiensi pelayanan, meliputi kecepatan pelayanan, ketepatan pengelolaan data pelanggan, serta kemudahan dalam tindak lanjut pelanggan. Sistem automasi E-CRM yang dikaji dirancang menggunakan bahasa pemrograman PHP dan basis data MySQL. Hasil penelitian menunjukkan bahwa penerapan automasi E-CRM mampu meningkatkan efisiensi pelayanan secara signifikan. Sistem ini mempermudah pengelolaan data pelanggan secara terintegrasi, mempercepat proses pelayanan, serta mendukung komunikasi yang lebih personal melalui fitur notifikasi dan pencatatan histori transaksi.
Kata kunci: automasi; e-crm; efisiensi pelayanan; ritel fashion.
Abstract:Abstract: Malaria remains a major global health problem, particularly in tropical countries such as Indonesia. Accurate early diagnosis is essential for reducing malaria-related morbidity and mortality. Conventional microscopic…
oscopic examination is time-consuming, highly dependent on expert personnel, and prone to human error. This study compares the performance of two Convolutional Neural Network (CNN) architectures, ResNet-50 and DenseNet-121, for malaria image classification. The Cell Images for Malaria dataset provided by the National Institutes of Health (NIH) through Kaggle was used, consisting of 27,558 microscopic blood cell images categorized into Parasitized and Uninfected classes. The dataset was divided into 80% training data and 20% testing data. Image preprocessing included resizing to 224 × 224 pixels, normalization, labeling, and data augmentation using RandomFlip, RandomRotation, RandomZoom, and RandomContrast. Experimental results showed that the ResNet-50 model trained for 100 epochs achieved the highest performance, with an accuracy of 95.54% and precision, recall, and F1-score of 0.96. The confusion matrix indicated 5,272 correctly classified images out of 5,510 testing samples. These findings demonstrate that ResNet-50 outperformed DenseNet-121 and has strong potential for supporting accurate, reliable, and efficient computer-aided malaria diagnosis based on microscopic blood smear images.
Keywords: computer-aided diagnosis; convolutional neural network (CNN); densenet-121; early detection; image classification; malaria; microscopic blood smear images; resnet-50;
Abstrak : Malaria masih menjadi masalah kesehatan global yang serius, terutama di negara tropis seperti Indonesia. Diagnosis dini yang akurat sangat penting untuk menurunkan angka morbiditas dan mortalitas. Metode konvensional berupa pemeriksaan mikroskopis memiliki keterbatasan karena memerlukan waktu yang relatif lama, bergantung pada tenaga ahli, dan berpotensi menimbulkan kesalahan manusia. Penelitian ini bertujuan membandingkan kinerja arsitektur Convolutional Neural Network (CNN) yaitu ResNet-50 dan DenseNet-121 dalam klasifikasi citra malaria. Dataset yang digunakan berasal dari Cell Images for Malaria yang disediakan oleh National Institutes of Health (NIH) melalui platform Kaggle, terdiri dari 27.558 citra dengan pembagian 80% data latih, 20% data validasi. Tahap praproses meliputi cleaning, resizing citra menjadi 224×224 piksel, normalisasi, labeling, serta data augmentasi menggunakan RandomFlip, RandomRotation, RandomZoom, dan RandomContrast. Hasil pengujian menunjukkan bahwa model ResNet-50 pada epoch 100 memperoleh akurasi sebesar 95,54% dengan nilai precision, recall, dan F1-score masing-masing sebesar 0,96. Confusion matrix menunjukkan jumlah prediksi benar sebanyak 5.272 dari total 5.510 data uji. Hasil ini menunjukkan bahwa arsitektur CNN mampu mengklasifikasikan citra malaria dengan tingkat akurasi yang tinggi dan memiliki kemampuan generalisasi yang baik terhadap data baru. Penelitian ini memberikan kontribusi dalam evaluasi performa arsitektur CNN untuk mendukung pengembangan sistem diagnosis malaria berbasis citra mikroskopis yang lebih cepat dan akurat.
Kata kunci: convolutional neural network (CNN); citra mikroskopis hapusan darah; densenet-121; diagnosis berbantuan komputer; deteksi dini; klasifikasi citra; malaria; resnet-50
Abstract:Abstract: Mental health is an essential aspect of overall well-being, particularly for university students vulnerable to emotional strain. This study aims to identify clusters of student mental health trends using the K-Means…
Means clustering technique. The research involved 60 students from four academic programs at the Faculty of Science and Technology, selected using stratified and cluster sampling techniques. Data were collected using a modified Mental Health Inventory (MHI). The results revealed distinct commonalities among majors: the Statistics program was predominantly defined by the depressed cluster at 53.3%, while Mathematics followed at 40% within the same cluster. In contrast, Biology students predominantly fell under the neu-tral/stable cluster (66.7%), whilst Information Systems students exhibited an even distribution (33.3% per cluster) without a dominant trend. The clustering quality was evaluated using the Silhouette Coefficient, yielding a range of 0.39 to 0.60. Biology (0.60) and Statistics (0.54) exhibited a reasonable structure, but Information Systems (0.39) and Mathematics (0.34) demonstrated a deficient structure. In conclusion, K-Means effectively discerns mental health patterns, providing a data-driven basis for targeted psychological interventions in educational settings.
Keywords: biology; information systems; k-means; mathematics; mental health; silhouette coefficient; statistics
Abstrak: Kesehatan mental merupakan komponen vital dari kesejahteraan total, terutama bagi maha-siswa yang rentan terhadap stres emosional. Penelitian ini bertujuan untuk mengidentifikasi kelompok tren kesehatan mental mahasiswa melalui penerapan metode pengelompokan K-Means. Studi ini mencakup 60 mahasiswa dari empat program studi di Fakultas Sains dan Teknologi, yang dipilih melalui metode pengambilan sampel bertingkat dan kelompok. Data dikumpulkan dengan menggunakan Inventaris Kesehatan Mental (MHI) yang dimodifikasi. Temuan menunjukkan kesamaan yang jelas di antara jurusan: program studi Statistika terutama ditandai oleh kelompok depresi (53,3%), diikuti oleh Matematika dengan 40% dalam kelompok depresi. Sebaliknya, mahasiswa Biologi terutama termasuk dalam kelompok netral/stabil (66,7%), sedangkan mahasiswa Sistem Informasi memiliki distribusi yang merata (33,3% per kelompok) tanpa pola yang dominan. Kualitas pengelompokan dinilai dengan Koefisien Sil-houette, menghasilkan rentang 0,39 hingga 0,60. Biologi (0,60) dan Statistika (0,54) memiliki struktur sedang, sedangkan Sistem Informasi (0,39) dan Matematika (0,34) menunjukkan struktur yang buruk. Kesimpulannya, K-Means secara akurat mengidentifikasi tren kesehatan mental, menawarkan landasan berbasis data untuk terapi psikologis yang ditargetkan di ling-kungan pendidikan.
Kata kunci: biologi; kesehatan mental; K-Means; matematika; silhouette coefficient; sistem in-formasi; statistika