Abstract:Abstract: Recommendation systems are becoming increasingly important with the growth of streaming platforms. The purpose of this study is to compare the performance of Content-Based Filtering, Neural Collaborative Filtering,…
ing, and a combination of both in a movie recommendation system. The method used in this study involves retrieving movie details from the TMDB API and ratings from the MovieLens 32M Dataset (2010-2023). Each model's performance is evaluated using evaluation metrics such as RMSE and MAE. The results of this study indicate that Neural Collaborative Filtering achieves the best prediction performance (RMSE = 0.785423, MAE = 0.581262), followed by the hybrid model (RMSE = 0.800863, MAE = 0.660872), while Content-Based Filtering produces low performance and limits the capabilities of the hybrid model. In conclusion, these findings highlight the superiority of latent feature-based models such as NCF that learn directly from user interaction patterns over content-based approaches in the context of modern recommendation systems.
Keywords: content-based filtering; hybrid filtering; movie recommendation; neural collaborative filtering.
Abstrak: Sistem rekomendasi menjadi semakin penting seiring berkembangnya platform streaming. Tujuan dari penelitian ini adalah membandingkan kinerja Content-Based Filtering, Neural Collaborative Filtering dan kombinasi keduanya dalam sistem rekomendasi film. Metode yang digunakan dalam penelitian ini melibatkan pengambilan detail film dari TMDB API dan rating dari dataset MovieLens 32M Dataset (2010-2023). Setiap peforma model dievaluasi dengan menggunakan metrik evaluasi seperti RMSE dan MAE. Hasil dari penelitian ini menunjukkan bahwa Neural Collaborative Filtering mencapai kinerja prediksi terbaik (RMSE = 0.785423, MAE = 0.581262), diikuti oleh model hybrid (RMSE = 0.800863, MAE = 0.660872), sementara Content-Based Filtering menghasilkankan peforma yang rendah dan membatasi kemampuan model hybrid. Kesimpulannya, penelitian ini menyoroti superiotas model berbasis latent feature seperti NCF yang belajar langsung dari pola interaksi pengguna dibandingkan pendekatan berbasis konten dalam konteks sistem rekomendasi modern.
Kata kunci: content-based filtering; hybrid filtering; neural collaborative filtering; rekomendasi film.
Abstract:Abstract: This study applies an integrated approach to optimize heart failure classification. The main objective is to address the challenge of class imbalance in medical datasets and to improve the accuracy, sensitivity,…
, and generalization of the classification model. The urgency of this issue is emphasized by statistics showing that cardiovascular diseases cause approximately 17.9 million deaths worldwide each year. Using a quantitative experimental approach, this study analyzes the "Heart Failure Prediction Dataset" from Kaggle, which consists of 918 records. The data were processed through normalization and encoding, followed by the application of SMOTE on the training set to balance class distribution. This step successfully increased model accuracy from 88.41% to 90.22% and minority class recall from 0.82 to 0.88. Furthermore, Bayesian Optimization was employed to refine the hyperparameters of SVM, resulting in a final model with an accuracy of 89.13% that demonstrated better generalization. This integrated approach significantly enhances the stability, sensitivity, and generalization of the model, making it a reliable tool for clinical decision support systems in predicting heart failure.
Keywords: bayesian optimization; heart failure; machine learning; SMOTE; SVM.
Abstrak: Penelitian ini menerapkan pendekatan terintegrasi untuk mengoptimalkan klasifikasi gagal jantung. Tujuan utama studi ini adalah untuk mengatasi tantangan ketidakseimbangan kelas dalam dataset medis dan meningkatkan akurasi, sensitivitas, serta generalisasi model klasifikasi. Urgensi ini ditegaskan oleh statistik yang menunjukkan bahwa penyakit kardiovaskular menyebabkan sekitar 17,9 juta kematian setiap tahun secara global. Menggunakan pendekatan eksperimental kuantitatif, penelitian ini menganalisis "Heart Failure Prediction Dataset" dari Kaggle, yang terdiri dari 918 catatan. Data diproses dengan normalisasi dan encoding, lalu SMOTE diterapkan pada data pelatihan untuk menyeimbangkan distribusi kelas. Langkah ini berhasil meningkatkan akurasi dari 88,41% menjadi 90,22% dan recall kelas minoritas dari 0,82 menjadi 0,88. Selanjutnya, Bayesian Optimization menyempurnakan hyperparameter SVM, menghasilkan model akhir dengan akurasi 89,13% yang menunjukkan generalisasi lebih baik. Pendekatan terintegrasi ini secara signifikan meningkatkan stabilitas, sensitivitas, dan generalisasi model. Hasil penelitian ini menjadikannya alat yang andal untuk sistem pendukung keputusan klinis dalam prediksi gagal jantung.
Kata kunci: bayesian optimization; gagal jantung; machine learning; SMOTE; SVM
Abstract:Abstract: On-time graduation is an important indicator in measuring the success of higher education and reflects the effectiveness of the academic process in higher education. Royal University, especially the Information…
Systems Study Program, still faces challenges in increasing the percentage of students who graduate on time. This study aims to identify factors that influence students' on-time graduation and build a prediction model using the multiple linear regression method. This method was chosen because it is able to analyze the simultaneous influence of several independent numeric variables on one dependent variable, making it suitable for studying the complex relationship between factors that influence student graduation. The independent variables analyzed in this study include GPA, parental income, and student part-time jobs with student graduation as the dependent variable. The results showed that parental income and part-time jobs had a significant positive effect on on-time graduation, while GPA had a negative effect. The model built had an R² value of 0.6153 and a standard error of 4.0653, indicating that the model was quite strong and accurate. These findings recommend Universitas Royal to strengthen the academic monitoring system and support working students, as well as design policies based on students' socio-economic conditions to increase the on-time graduation rate.
Keywords: multiple linear regression; on-time graduation; students.
Abstrak: Kelulusan tepat waktu merupakan indikator penting dalam mengukur keberhasilan pendidikan tinggi serta mencerminkan efektivitas proses akademik di perguruan tinggi. Universitas Royal, khususnya Program Studi Sistem Informasi, masih menghadapi tantangan dalam meningkatkan persentase mahasiswa yang lulus tepat waktu. Penelitian ini bertujuan untuk mengidentifikasi faktor-faktor yang memengaruhi kelulusan tepat waktu mahasiswa serta membangun model prediksi menggunakan metode regresi linear berganda. Metode ini dipilih karena mampu menganalisis pengaruh simultan beberapa variabel independen numerik terhadap satu variabel dependen, sehingga sesuai untuk mengkaji hubungan kompleks antar faktor yang memengaruhi kelulusan mahasiswa. Variabel independen yang dianalisis dalam penelitian ini meliputi IPK, penghasilan orangtua, dan pekerjaan sambilan mahasiswa dengan kelulusan mahasiswa sebagai variabel dependen. Hasil penelitian menunjukkan bahwa penghasilan orangtua dan pekerjaan sambilan berpengaruh positif signifikan terhadap kelulusan tepat waktu, sedangkan IPK justru memiliki pengaruh negatif. Model yang dibangun memiliki nilai R² sebesar 0,6153 dan standar error 4,0653, menandakan model cukup kuat dan akurat. Temuan ini merekomendasikan Universitas Royal untuk memperkuat sistem monitoring akademik dan mendukung mahasiswa yang bekerja, serta merancang kebijakan berbasis kondisi sosial-ekonomi mahasiswa guna meningkatkan angka kelulusan tepat waktu.
Kata kunci: kelulusan tepat waktu; mahasiswa; regresi linear berganda.
Abstract:Abstract: The inability to accurately monitor the lifespan of motorcycle batteries can lead to sudden failures, disrupt user activities, and increase maintenance costs. This issue is exacerbated by the absence of a predictive…
ctive system that can assist users and workshops in planning maintenance and managing battery inventory effectively. This study aims to develop a battery lifespan prediction model for motorcycles using the Double Moving Average (DMA) method. The model is built based on historical data from 12 motorcycle units, including usage frequency, duration, terrain conditions, and maintenance habits. Forecasting is conducted through two stages of moving averages followed by trend parameter calculations. Evaluation results show that the model has a high level of accuracy, with MAPE = 0.10, MAD = 1.68, and RMSE = 2.14, indicating very low prediction errors. In addition, DMA is also used to forecast product demand at PT Anugerah Karya Abiwara Kisaran to prevent stock shortages. The system is developed using Visual Studio 2010 and Microsoft Access and has proven effective in supporting maintenance planning and inventory control. With its high accuracy and efficiency, the results of this study provide tangible contributions to decision-making in battery maintenance and inventory management.
Keywords: battery; DMA; motorcycle; prediction.
Abstrak: Ketidakmampuan dalam memantau usia pakai aki sepeda motor secara akurat dapat menyebabkan kerusakan mendadak, mengganggu aktivitas pengguna, serta meningkatkan biaya perawatan. Permasalahan ini diperburuk oleh tidak tersedianya sistem prediktif yang membantu pengguna dan bengkel dalam merencanakan perawatan serta mengelola persediaan aki secara efisien. Penelitian ini bertujuan untuk mengembangkan model prediksi usia pemakaian aki sepeda motor dengan menggunakan metode Double Moving Average (DMA). Model dibangun berdasarkan data historis dari 12 unit sepeda motor yang mencakup frekuensi penggunaan, durasi, kondisi medan dan kebiasaan perawatan. Proses peramalan dilakukan melalui dua tahap perataan bergerak, yang kemudian diikuti dengan perhitungan parameter tren. Hasil evaluasi menunjukkan bahwa model ini memiliki tingkat akurasi yang tinggi, dengan nilai MAPE sebesar 0,10, MAD sebesar 1,68, dan RMSE sebesar 2,14, yang mengindikasikan tingkat kesalahan prediksi yang sangat rendah. Selain itu, metode DMA juga diterapkan untuk meramalkan permintaan produk pada PT Anugerah Karya Abiwara Kisaran guna mencegah terjadinya kekurangan stok. Sistem dikembangkan menggunakan Visual Studio 2010 dan Microsoft Access, serta terbukti efektif dalam mendukung perencanaan perawatan dan pengendalian persediaan. Dengan akurasi dan efisiensi yang tinggi, hasil penelitian ini memberikan kontribusi nyata dalam pengambilan keputusan terkait pemeliharaan aki dan manajemen inventori.
Kata kunci: baterai; DMA; prediksi; sepeda motor.
Abstract:Abstract: Non-performing loans remain one of the main challenges faced by cooperatives, particularly when the loan eligibility assessment process is still conducted manually. This traditional approach tends to be time consuming,…
nsuming, subjective, and prone to inaccurate decisions. This study aims to develop a predictive model for borrower eligibility using the Support Vector Machine (SVM) algorithm as a more efficient and objective machine learning-based solution. A total of 1,000 loan history records were processed using RapidMiner software, taking into account variables such as salary, years of employment, loan amount, monthly installment, employment status, monthly expenses, number of dependents, housing status, age, and collateral value. The model’s performance was evaluated using a confusion matrix and classification metrics including accuracy, precision, recall, and kappa. The results indicate that the SVM model achieved an accuracy of 90.05%, precision of 90.13%, recall of 90.05%, and f1 score of 90,08%, reflecting a strong performance in classifying borrower eligibility. The application of this method makes a significant contribution to the development of data driven decision support systems within cooperative environments. This finding expands the scientific understanding in the field of microfinance and supports the implementation of artificial intelligence technologies in making decisions that are more precise, rapid, and accurate.
Keywords: cooperative; eligibility prediction; machine learning; non-performing loan; SVM
Abstrak: Kredit macet merupakan salah satu permasalahan utama yang dihadapi koperasi, terutama ketika proses penilaian kelayakan peminjam masih dilakukan secara manual. Pendekatan ini cenderung lambat, subjektif, dan berisiko menghasilkan keputusan yang kurang akurat. Penelitian ini bertujuan untuk membangun model prediksi kelayakan peminjam menggunakan algoritma Support Vector Machine (SVM) sebagai solusi berbasis machine learning yang lebih efisien dan objektif. Sebanyak 1.000 data riwayat pinjaman diolah menggunakan tools RapidMiner dengan mempertimbangkan variabel: gaji, lama bekerja, besar pinjaman, angsuran per bulan, status pegawai, pengeluaran bulanan, jumlah tanggungan, status rumah, umur, dan nilai jaminan. Evaluasi model dilakukan menggunakan confusion matrix dan metrik klasifikasi seperti akurasi, presisi, recall, dan kappa. Hasil menunjukkan bahwa model SVM mencapai akurasi 90,05%, presisi 90,13%, recall 90,05%, dan f1 score 90,08%, yang mencerminkan performa model yang sangat baik dalam mengklasifikasikan kelayakan peminjam. Penerapan metode ini memberikan kontribusi penting dalam pengembangan sistem pendukung keputusan berbasis data di lingkungan koperasi. Temuan ini memperluas wawasan keilmuan di bidang keuangan mikro dan mendukung penerapan teknologi kecerdasan buatan dalam pengambilan keputusan yang lebih tepat, cepat, dan akurat.
Kata Kunci: koperasi; kredit macet; machine learning; prediksi kelayakan; SVM
Abstract:Abstract: This research is driven by the challenges faced by Universitas Lancang Kuning (UNILAK) in attracting applicants amidst intense competition, especially after the government's policy opened independent pathways to…
o State Universities (PTN) from 2022-2023, which impacted private university applicant numbers. To address this and support strategic planning, this study aims to predict the trend of prospective students applying to all study programs at UNILAK for the period 2025-2027. Two time series models were employed: ARIMA (AutoRegressive Integrated Moving Average) and LSTM (Long Short-Term Memory). Applicant data from 2019 to 2024 was used to build the model. The Augmented Dickey-Fuller (ADF) test confirmed the data's stationarity with a p-value of 0.0. ACF and PACF analyses determined the ARIMA parameters as p=1, d=1, q=1. The LSTM model was trained to capture more complex data patterns. ARIMA predictions for 2025, 2026, and 2027 are 3298.66, 3362.33, and 3371.30, respectively. LSTM predictions for the same years are 3335.64, 3476.52, and 3518.42. Evaluation using Root Mean Squared Error (RMSE) showed ARIMA (RMSE=588.72) to be more accurate than LSTM (RMSE=653.96). Nevertheless, LSTM provided a more optimistic prediction. This study concludes that ARIMA is better suited for short-term planning, while LSTM can be used for more ambitious long-term strategies.
Keywords: arima; LSTM; applicants; prediction; university
Abstrak: Penelitian ini didorong oleh tantangan Universitas Lancang Kuning (UNILAK) dalam menarik pendaftar di tengah persaingan ketat, khususnya setelah kebijakan pemerintah membuka jalur mandiri ke Perguruan Tinggi Negeri (PTN) sejak 2022-2023, yang menyebabkan penurunan jumlah pendaftar di universitas swasta. Untuk mendukung perencanaan strategis, studi ini bertujuan memprediksi tren jumlah calon mahasiswa yang mendaftar ke seluruh program studi di UNILAK untuk periode 2025-2027.Dua model deret waktu digunakan: ARIMA (AutoRegressive Integrated Moving Average) dan LSTM (Long Short-Term Memory). Data jumlah pendaftar dari 2019 hingga 2024 digunakan untuk membangun model. Uji Augmented Dickey-Fuller (ADF) menunjukkan data stasioner dengan p-value 0,0. Analisis ACF dan PACF menentukan parameter ARIMA sebagai p=1, d=1, q=1. Model LSTM dilatih untuk menangkap pola data yang lebih kompleks.Prediksi ARIMA untuk 2025, 2026, dan 2027 adalah 3298.66, 3362.33, dan 3371.30. Prediksi LSTM untuk tahun yang sama adalah 3335.64, 3476.52, dan 3518.42. Evaluasi menggunakan Root Mean Squared Error (RMSE) menunjukkan ARIMA (RMSE=588.72) lebih akurat daripada LSTM (RMSE=653.96). Meskipun demikian, LSTM memberikan prediksi yang lebih optimis. Studi ini menyimpulkan ARIMA lebih cocok untuk perencanaan jangka pendek, sementara LSTM dapat digunakan untuk strategi jangka panjang yang ambisius.
Kata kunci: arima; LSTM; pendaftar; prediksi; universitas
Abstract:Abstract: Air quality in urban areas is becoming an increasingly important issue considering its impact on human health and the environment. The rapid increase in air pollution requires effective methods to predict air quality…
uality in order to take appropriate mitigation measures. This study aims to analyze the use of Neural Network (NN) algorithms in predicting air quality in cities. The method used is the application of the NN model, especially the Multilayer Perceptron (MLP), which is trained using historical air quality data such as dust particle levels (PM10, PM2.5), carbon monoxide (CO) gas, and temperature. The data used in this study came from urban air quality monitoring stations collected over a period of time. The results show that the Neural Network algorithm can provide quite accurate predictions of air quality with a low Mean Absolute Error (MAE) value, showing the effectiveness of the model in predicting f fluctuations in air quality. The conclusion of this study is that Neural Network algorithms, specifically MLPs, are an effective tool for air quality prediction, which can be used as a basis for urban air quality management policies.
Keywords: air quality; neural network; prediction; multilayer perceptron (MLP)
Abstrak: Kualitas udara di perkotaan menjadi isu yang semakin penting mengingat dampaknya terhadap kesehatan manusia dan lingkungan. Peningkatan polusi udara yang pesat memerlukan metode yang efektif untuk memprediksi kualitas udara guna mengambil langkah mitigasi yang tepat. Penelitian ini bertujuan untuk menganalisis penggunaan algoritma Neural Network (NN) dalam memprediksi kualitas udara di perkotaan. Metode yang digunakan adalah penerapan model NN, khususnya Multilayer Perceptron (MLP), yang dilatih menggunakan data kualitas udara historis seperti kadar partikel debu (PM10, PM2.5), gas karbon monoksida (CO), dan suhu. Data yang digunakan dalam penelitian ini berasal dari stasiun pemantauan kualitas udara di perkotaan yang dikumpulkan selama periode waktu tertentu. Hasil penelitian menunjukkan bahwa algoritma Neural Network dapat memberikan prediksi yang cukup akurat terhadap kualitas udara dengan nilai Mean Absolute Error (MAE) yang rendah, menunjukkan efektivitas model dalam memprediksi fluktuasi kualitas udara. Simpulan dari penelitian ini adalah bahwa algoritma Neural Network, khususnya MLP, merupakan alat yang efektif untuk prediksi kualitas udara, yang dapat digunakan sebagai dasar untuk kebijakan pengelolaan kualitas udara di perkotaan
Kata kunci: kualitas udara; neural network; prediksi; multilayer perceptron (MLP)
Abstract:Abstract: The Halodoc application, as a digital healthcare service platform, has been widely used for various medical purposes, such as doctor consultations, medication purchases, and laboratory services. User interactions…
ns and reviews play a crucial role in enhancing service quality. Sentiment analysis was conducted using the Support Vector Machine (SVM) method to assess user perceptions and satisfaction based on reviews obtained from the Google Play Store platform. The analysis process included data collection, text preprocessing, data transformation using TF-IDF, and training an SVM model to predict sentiment. The model achieved its highest accuracy of 88.32% in the first scenario. However, accuracy slightly decreased in the second and third scenarios, reaching 86.25% and 86.94%, respectively. The analysis results indicated that the model performed best in the first scenario, with the lowest number of prediction errors. Additionally, the model was more accurate in classifying negative and positive sentiments than neutral ones.
Keywords: halodoc application; sentiment analysis; support vector machine algorithm
Abstrak: Aplikasi Halodoc, sebagai platform layanan kesehatan digital, telah banyak digunakan untuk berbagai keperluan medis seperti konsultasi dokter, pembelian obat, dan layanan laboratorium. Interaksi pengguna dan ulasan mereka memiliki peran krusial dalam meningkatkan mutu layanan. Analisis sentimen dilakukan dengan menggunakan metode Support Vector Machine (SVM) untuk mengetahui persepsi dan kepuasan pengguna berdasarkan ulasan yang diperoleh dari Platform Google Play Store. Proses analisis mencakup pengumpulan data, pra-pemrosesan teks, transformasi data menggunakan TF-IDF, dan pelatihan model SVM untuk memprediksi sentimen. Hasil pelatihan model dengan akurasi tertinggi sebesar 88,32% pada skenario pertama. Akurasi sedikit menurun pada skenario kedua dan ketiga, masing-masing sebesar 86,25% dan 86,94%, Hasil analisa menunjukkan bahwa model memiliki performa terbaik pada skenario pertama dengan jumlah kesalahan prediksi terkecil. Selain itu, model cenderung lebih akurat dalam mengklasifikasikan sentimen negatif dan positif dibandingkan netral..
Kata kunci: algoritma support vector machine; analisis sentimen; aplikasi halodoc
Abstract:Abstract: Ms Glow Kisaran Original Store is one of the beauty companies that sells skincare products that are useful for maintaining healthy facial and body skin. However, the Original Ms. Glow series currently faces challenges…
hallenges such as tight competition and ineffective inventory management in terms of sales figures. This company sells ± 1500 products a month, but also often faces shortages and stockpiles of product, which can reduce customer confidence and cause Ms. Glow Kisaran Original to experience financial losses, among others. Conversely, if the demand for skincare increases but the skincare supply cannot be prepared, this is a loss for the store and customers. The purpose of this study is to improve the accuracy of the forecast, the use of the Single Exponential Smoothing Method is proposed. This method smoothes past values with exponential weights, placing greater emphasis on the latest data. The use of data from the last 12 months as reference data for past recording for forecasting experiments for the next 1 (one) month. The results of the study at Ms Glow Kisaran show the flexibility of the method in adapting to different sales dynamics. Overall, this research helps in predicting skincare sales predictions at the Ms Glow Kisaran Original Kisaran Store using the Single Exponentian Smoothing method, so that it can overcome the challenges in predicting sales figures.
Keywords: ms glow kisaran; skincare sales; ses.
Abstrak: Toko Ms Glow Kisaran Original merupakan salah satu perusahaan di bidang kecantikan yang menjual produk-produk skincare yang bermanfaat untuk menjaga kesehatan kulit wajah dan tubuh. Namun rangkaian Original Ms. Glow saat ini menghadapi tantangan seperti persaingan yang ketat dan pengelolaan inventaris yang kurang efektif dalam hal angka penjualan. Perusahaan ini menjual ±1500 produk dalam sebulan, namun juga sering menghadapi kekurangan dan penumpukan stok produk, yang dapat menurunkan kepercayaan pelanggan dan menyebabkan Ms. Glow Kisaran Original mengalami kerugian finansial. Sebaliknya jika permintaan akan skincare meningkat namun persediaan skincare tidak dapat disiapkan maka ini menjadi kerugian bagi pihak toko dan pelanggan. Tujuan penelitian ini adalah untuk meningkatkan ketepatan perkiraan, penggunaan Metode Single Exponential Smoothing diusulkan. Metode ini menghaluskan nilai masa lalu dengan bobot eksponensial, memberikan penekanan lebih besar pada data terbaru. Penggunaan data 12 bulan terakhir sebagai data acuan pencatatan masa lalu untuk percobaan peramalan untuk 1 (satu) bulan kedepan. Hasil penelitian pada Ms Glow Kisaran menunjukkan fleksibilitas metode dalam menyesuaikan diri dengan dinamika penjualan yang berbeda. Secara keseluruhan, Penelitian ini membantu dalam meramalkan prediksi penjualan skincare di Toko Ms glow Kisaran Original Kisaran menggunakan metode Single Exponentian Smoothing, sehingga dapat mengatasi tantangan dalam memprediksi angka penjualan.
Kata kunci: ms glow kisaran; penjualan skincare; ses.
Abstract:Abstract: Breast cancer is the leading cause of death for women globally, exacerbated by late detection. This study proposes a breast cancer risk prediction framework using XGBoost with SelectKBest feature selection. It…
aims to improve the accuracy and efficiency of early detection through exploratory data analysis, coding, SMOTE to address class imbalance, and feature selection (k=29). As a result, the XGBoost model achieved 98.1% accuracy, 98.1% recall, 98.1% f1-score, and 98.2% precision on test data, highlighting the importance of feature selection. These results are promising in patient prioritization (triage) for further examination, helping medical personnel identify high-risk patients, thus improving resource allocation efficiency. These findings validate SelectKBest and pave the way for the development of a machine learning-based clinical decision support system for breast cancer early detection workflows. This research contributes significantly to the application of machine learning to support early breast cancer detection.
Keywords: breast cancer; feature selection; machine learning; risk prediction; XGBOOST.
Abstrak: Kanker payudara menjadi penyebab utama kematian wanita global, diperparah deteksi yang terlambat. Penelitian ini mengusulkan kerangka prediksi risiko kanker payudara menggunakan XGBoost dengan seleksi fitur SelectKBest. Tujuannya meningkatkan akurasi dan efisiensi deteksi dini melalui analisis data eksploratif, pengkodean, SMOTE untuk mengatasi ketidakseimbangan kelas, dan seleksi fitur (k=29). Hasilnya, model XGBoost mencapai akurasi 98.1%, recall 98.1%, f1-score 98.1%, dan presisi 98.2% pada data uji, menyoroti pentingnya seleksi fitur. Hasil ini menjanjikan dalam penentuan prioritas pasien (triage) untuk pemeriksaan lebih lanjut, membantu tenaga medis mengidentifikasi pasien berisiko tinggi, sehingga meningkatkan efisiensi alokasi sumber daya. Temuan ini memvalidasi SelectKBest dan membuka jalan bagi pengembangan sistem pendukung keputusan klinis berbasis machine learning untuk alur kerja deteksi dini kanker payudara. Penelitian ini berkontribusi signifikan dalam penerapan machine learning untuk mendukung deteksi dini kanker payudara.
Kata kunci: kanker payudara; pembelajaran mesin; prediksi risiko ; seleksi fitur; XGBOOST.