Abstract:Abstract: The increasing use of digital banking applications has led to the need for a deeper understanding of user perceptions, especially through aspect-based sentiment analysis. This study aims to classify the sentiment…
nt of SeaBank app users by focusing on four main aspects: learnability, efficiency, technical issues or errors, and satisfaction. Review data totaling 1,971 comments were collected from the Google Play Store and labeled with sentiments based on the scores (ratings) given by users. The CRISP-DM approach serves as the methodological framework for this study, which includes five classification algorithms: Naïve Bayes, Support Vector Machine (SVM), k-Nearest Neighbor (k-NN), Decision Tree, and Random Forest. The evaluation results show that the SVM algorithm provides the best performance with the highest average value of the four aspects achieving accuracy of 93.91%, Precision of 91.16%, recall of 97.96% and F1-Measure of 94.33%. According to the research findings, the Support Vector Machine (SVM) algorithm provides the best performance when performing aspect-based sentiment analysis on text data from digital banking application reviews. The findings are expected to serve as a reference for the development of automated evaluation systems that rely on user opinions as the basis for decision making.
Keywords: aspects; CRISP-DM; digital Banking; seabank; sentiment analysis
Abstrak: Peningkatan pemakaian aplikasi perbankan digital mendorong perlunya pemahaman yang lebih dalam mengenai persepsi pengguna, terutama melalui analisis sentimen berbasis aspek. Penelitian ini bertujuan untuk mengklasifikasikan sentimen pengguna aplikasi SeaBank dengan berfokus pada empat aspek utama: kemudahan dipelajari (learnability), efisiensi penggunaan (efficiency), kendala atau kesalahan teknis (error), serta tingkat kepuasan (satisfaction). Data ulasan berjumlah 1.971 komentar dikumpulkan dari Google Play Store dan diberi label sentimen berdasarkan skor (rating) yang diberikan oleh pengguna. Pendekatan CRISP-DM berfungsi sebagai kerangka metodologis untuk penelitian ini, yang mencakup lima algoritma klasifikasi: Naïve Bayes, Support Vector Machine (SVM), k-Nearest Neighbor (k-NN), Decision Tree, dan Random Forest. Hasil evaluasi menunjukkan bahwa algoritma SVM memberikan performa terbaik dengan nilai rata-rata dari ke empat aspek tertinggi yang mencapai accuracy sebesar 93.91%, Precision sebesar 91.16%, recall sebesar 97.96% dan F1-Measure sebesar 94.33%. Menurut temuan penelitian, algoritma Support Vector Machine (SVM) memberikan kinerja terbaik saat melakukan analisis sentimen berbasis aspek pada data teks dari ulasan aplikasi Seabank. Temuan ini diharapkan dapat menjadi referensi bagi pengembangan sistem evaluasi otomatis yang mengandalkan opini pengguna sebagai dasar pengambilan keputusan.
Kata kunci: Analisis Sentimen, Aspek, Bank Digital, SeaBank, CRISP-DM
Abstract:Abstract: This study applies an integrated approach to optimize heart failure classification. The main objective is to address the challenge of class imbalance in medical datasets and to improve the accuracy, sensitivity,…
, and generalization of the classification model. The urgency of this issue is emphasized by statistics showing that cardiovascular diseases cause approximately 17.9 million deaths worldwide each year. Using a quantitative experimental approach, this study analyzes the "Heart Failure Prediction Dataset" from Kaggle, which consists of 918 records. The data were processed through normalization and encoding, followed by the application of SMOTE on the training set to balance class distribution. This step successfully increased model accuracy from 88.41% to 90.22% and minority class recall from 0.82 to 0.88. Furthermore, Bayesian Optimization was employed to refine the hyperparameters of SVM, resulting in a final model with an accuracy of 89.13% that demonstrated better generalization. This integrated approach significantly enhances the stability, sensitivity, and generalization of the model, making it a reliable tool for clinical decision support systems in predicting heart failure.
Keywords: bayesian optimization; heart failure; machine learning; SMOTE; SVM.
Abstrak: Penelitian ini menerapkan pendekatan terintegrasi untuk mengoptimalkan klasifikasi gagal jantung. Tujuan utama studi ini adalah untuk mengatasi tantangan ketidakseimbangan kelas dalam dataset medis dan meningkatkan akurasi, sensitivitas, serta generalisasi model klasifikasi. Urgensi ini ditegaskan oleh statistik yang menunjukkan bahwa penyakit kardiovaskular menyebabkan sekitar 17,9 juta kematian setiap tahun secara global. Menggunakan pendekatan eksperimental kuantitatif, penelitian ini menganalisis "Heart Failure Prediction Dataset" dari Kaggle, yang terdiri dari 918 catatan. Data diproses dengan normalisasi dan encoding, lalu SMOTE diterapkan pada data pelatihan untuk menyeimbangkan distribusi kelas. Langkah ini berhasil meningkatkan akurasi dari 88,41% menjadi 90,22% dan recall kelas minoritas dari 0,82 menjadi 0,88. Selanjutnya, Bayesian Optimization menyempurnakan hyperparameter SVM, menghasilkan model akhir dengan akurasi 89,13% yang menunjukkan generalisasi lebih baik. Pendekatan terintegrasi ini secara signifikan meningkatkan stabilitas, sensitivitas, dan generalisasi model. Hasil penelitian ini menjadikannya alat yang andal untuk sistem pendukung keputusan klinis dalam prediksi gagal jantung.
Kata kunci: bayesian optimization; gagal jantung; machine learning; SMOTE; SVM
Abstract:Abstract: Non-performing loans remain one of the main challenges faced by cooperatives, particularly when the loan eligibility assessment process is still conducted manually. This traditional approach tends to be time consuming,…
nsuming, subjective, and prone to inaccurate decisions. This study aims to develop a predictive model for borrower eligibility using the Support Vector Machine (SVM) algorithm as a more efficient and objective machine learning-based solution. A total of 1,000 loan history records were processed using RapidMiner software, taking into account variables such as salary, years of employment, loan amount, monthly installment, employment status, monthly expenses, number of dependents, housing status, age, and collateral value. The model’s performance was evaluated using a confusion matrix and classification metrics including accuracy, precision, recall, and kappa. The results indicate that the SVM model achieved an accuracy of 90.05%, precision of 90.13%, recall of 90.05%, and f1 score of 90,08%, reflecting a strong performance in classifying borrower eligibility. The application of this method makes a significant contribution to the development of data driven decision support systems within cooperative environments. This finding expands the scientific understanding in the field of microfinance and supports the implementation of artificial intelligence technologies in making decisions that are more precise, rapid, and accurate.
Keywords: cooperative; eligibility prediction; machine learning; non-performing loan; SVM
Abstrak: Kredit macet merupakan salah satu permasalahan utama yang dihadapi koperasi, terutama ketika proses penilaian kelayakan peminjam masih dilakukan secara manual. Pendekatan ini cenderung lambat, subjektif, dan berisiko menghasilkan keputusan yang kurang akurat. Penelitian ini bertujuan untuk membangun model prediksi kelayakan peminjam menggunakan algoritma Support Vector Machine (SVM) sebagai solusi berbasis machine learning yang lebih efisien dan objektif. Sebanyak 1.000 data riwayat pinjaman diolah menggunakan tools RapidMiner dengan mempertimbangkan variabel: gaji, lama bekerja, besar pinjaman, angsuran per bulan, status pegawai, pengeluaran bulanan, jumlah tanggungan, status rumah, umur, dan nilai jaminan. Evaluasi model dilakukan menggunakan confusion matrix dan metrik klasifikasi seperti akurasi, presisi, recall, dan kappa. Hasil menunjukkan bahwa model SVM mencapai akurasi 90,05%, presisi 90,13%, recall 90,05%, dan f1 score 90,08%, yang mencerminkan performa model yang sangat baik dalam mengklasifikasikan kelayakan peminjam. Penerapan metode ini memberikan kontribusi penting dalam pengembangan sistem pendukung keputusan berbasis data di lingkungan koperasi. Temuan ini memperluas wawasan keilmuan di bidang keuangan mikro dan mendukung penerapan teknologi kecerdasan buatan dalam pengambilan keputusan yang lebih tepat, cepat, dan akurat.
Kata Kunci: koperasi; kredit macet; machine learning; prediksi kelayakan; SVM
Abstract:Abstract: The Halodoc application, as a digital healthcare service platform, has been widely used for various medical purposes, such as doctor consultations, medication purchases, and laboratory services. User interactions…
ns and reviews play a crucial role in enhancing service quality. Sentiment analysis was conducted using the Support Vector Machine (SVM) method to assess user perceptions and satisfaction based on reviews obtained from the Google Play Store platform. The analysis process included data collection, text preprocessing, data transformation using TF-IDF, and training an SVM model to predict sentiment. The model achieved its highest accuracy of 88.32% in the first scenario. However, accuracy slightly decreased in the second and third scenarios, reaching 86.25% and 86.94%, respectively. The analysis results indicated that the model performed best in the first scenario, with the lowest number of prediction errors. Additionally, the model was more accurate in classifying negative and positive sentiments than neutral ones.
Keywords: halodoc application; sentiment analysis; support vector machine algorithm
Abstrak: Aplikasi Halodoc, sebagai platform layanan kesehatan digital, telah banyak digunakan untuk berbagai keperluan medis seperti konsultasi dokter, pembelian obat, dan layanan laboratorium. Interaksi pengguna dan ulasan mereka memiliki peran krusial dalam meningkatkan mutu layanan. Analisis sentimen dilakukan dengan menggunakan metode Support Vector Machine (SVM) untuk mengetahui persepsi dan kepuasan pengguna berdasarkan ulasan yang diperoleh dari Platform Google Play Store. Proses analisis mencakup pengumpulan data, pra-pemrosesan teks, transformasi data menggunakan TF-IDF, dan pelatihan model SVM untuk memprediksi sentimen. Hasil pelatihan model dengan akurasi tertinggi sebesar 88,32% pada skenario pertama. Akurasi sedikit menurun pada skenario kedua dan ketiga, masing-masing sebesar 86,25% dan 86,94%, Hasil analisa menunjukkan bahwa model memiliki performa terbaik pada skenario pertama dengan jumlah kesalahan prediksi terkecil. Selain itu, model cenderung lebih akurat dalam mengklasifikasikan sentimen negatif dan positif dibandingkan netral..
Kata kunci: algoritma support vector machine; analisis sentimen; aplikasi halodoc
Abstract:Abstract: The advancement of network security faces growing challenges as cyberattacks become more sophisticated. Traditional rule-based systems struggle with zero-day attacks and obfuscation techniques. This study examines…
nes the development trends of AI-based algo-rithms, particularly machine learning and deep learning, in threat detection. A literature review evaluates AI-driven approaches, including support vector machines, random for-est, deep neural networks, convolutional neural networks, and reinforcement learning. Findings show that AI enhances detection accuracy, adaptability, and reduces false posi-tives. Machine learning efficiently classifies known attacks, while deep learning excels in identifying complex patterns such as distributed denial-of-service and advanced persis-tent threats. Unsupervised learning improves anomaly detection without labeled data. However, AI models require high-quality data, substantial computational resources, and remain vulnerable to adversarial attacks. Despite these challenges, AI provides a dynam-ic and adaptive security solution, surpassing traditional systems. Future research should enhance AI scalability and resilience for evolving cybersecurity threats.
Keywords: anomaly detection; artificial intelligence; deep learning; machine learning; network security
Abstrak: Perkembangan keamanan jaringan menghadapi tantangan yang semakin besar seiring meningkatnya kompleksitas serangan siber. Sistem berbasis aturan tradisional kesulitan mendeteksi zero-day attack dan teknik penyamaran. Penelitian ini mengkaji tren pengembangan algoritma berbasis AI, khususnya machine learning dan deep learning, dalam deteksi ancaman. Literature review mengevaluasi pendekatan berbasis AI, termasuk support vector machines, random forest, deep neural networks, convolutional neural networks, dan reinforcement learning. Hasil penelitian menunjukkan bahwa AI meningkatkan akurasi deteksi, adaptabilitas terhadap ancaman baru, serta mengurangi false positive. Machine learning efektif mengklasifikasikan serangan yang telah diketahui, sementara deep learning unggul dalam mengenali pola kompleks seperti distributed denial-of-service dan advanced persistent threats. Unsupervised learning meningkatkan deteksi anomali tanpa memerlukan data berlabel. Namun, AI masih bergantung pada data berkualitas tinggi, sumber daya komputasi besar, dan rentan terhadap adversarial attack. Meskipun demikian, AI menawarkan solusi keamanan yang lebih dinamis dan adaptif dibandingkan sistem tradisional. Penelitian selanjutnya perlu difokuskan pada peningkatan skalabilitas dan ketahanan AI dalam menghadapi ancaman siber yang terus berkembang.
Kata kunci: deteksi anomali; jaringan keamanan; kecerdasan buatan; pembelajaran dalam; pembelajaran mesin
Abstract:Abstract: Heart disease is one of the leading causes of death worldwide, making early detection and accurate diagnosis crucial for reducing mortality rates and improving patient outcomes. This study aims to evaluate the…
effectiveness of four machine learning algorithms—Logistic Regression, Random Forest, Support Vector Machine (SVM), and K-Nearest Neighbors (KNN)—in predicting heart disease, with a focus on enhancing model performance using Linear Discriminant Analysis (LDA) for feature reduction. Among the models, SVM achieved the highest accuracy at 84.24%, followed by Logistic Regression at 83.70%. Although Random Forest and KNN showed lower accuracies, all models benefited from LDA's dimensionality reduction. This study suggests that SVM, combined with LDA, offers an optimal solution for early and accurate heart disease prediction in the healthcare industry.
Keywords: feature reduction; heart disease; linear discriminant analysis (LDA); machine learning; SVM
Abstrak: Penyakit jantung merupakan salah satu penyebab utama kematian di seluruh dunia, sehingga deteksi dini dan diagnosis yang akurat sangat penting untuk menurunkan angka kematian dan meningkatkan hasil pengobatan pasien. Penelitian ini bertujuan untuk mengevaluasi efektivitas empat algoritma pembelajaran mesin—Regresi Logistik, Random Forest, Support Vector Machine (SVM), dan K-Nearest Neighbors (KNN)—dalam memprediksi penyakit jantung, dengan fokus pada peningkatan kinerja model menggunakan Analisis Diskriminan Linear (LDA) untuk reduksi fitur. Di antara model yang diuji, SVM mencapai akurasi tertinggi sebesar 84,24%, diikuti oleh Regresi Logistik dengan 83,70%. Meskipun Random Forest dan KNN menunjukkan akurasi yang lebih rendah, semua model memperoleh manfaat dari reduksi dimensi yang diberikan oleh LDA. Studi ini menunjukkan bahwa SVM yang dikombinasikan dengan LDA merupakan solusi optimal untuk prediksi penyakit jantung secara dini dan akurat dalam industri kesehatan.
Kata kunci: linear discriminant analysis (LDA); machine learning; penyakit jantung; reduksi fitur; SVM.
Abstract:Abstract: Feature selection is a crucial process that is very important to improve the performance of machine learning models, in accordance with data preprocessing. The feature selection process can be considered as a global…
lobal combinatorial optimization problem in machine learning, which reduces the number of features, eliminates irrelevant data, and produces acceptable classification accuracy. The purpose of this study is to predict or determine the results of the electrical installation operation feasibility test based on data and obtain attribute selection features, and obtain accuracy level results. The Particle Swarm Optimization (PSO) approach is used to select the right characteristics to determine the results of the electrical installation operation feasibility test because attribute selection is needed in data analysis, because the PSO method will increase accuracy than just SVM in determining attribute selection. If SVM is used with PSO, the accuracy value is 96% and AUC is 0.994%, while the SVM method produces an accuracy level of 94.89% and AUC of 0.994%. With this finding, the accuracy value increases by 2%, making it a very good categorization category. It has been proven that the use of Particle Swarm Optimization (PSO) based algorithms can improve and improve results.
Keywords: PSO; SVM; Certification
Abstrak: Pemilihan fitur merupakan proses krusial yang sangat penting untuk meningkatkan kinerja model machine learning, sesuai dengan praproses data. Proses pemilihan fitur dapat dianggap sebagai masalah optimasi kombinatorial global dalam pembelajaran mesin, yang mengurangi jumlah fitur, menghilangkan data yang tidak relevan, dan menghasilkan akurasi klasifikasi yang dapat diterima. Tujuan dari penelitian ini adalah untuk memprediksi atau menentukan hasil uji kelayakan operasi instalasi listrik berdasarkan data dan memperoleh fitur pemilihan atribut, serta memperoleh hasil tingkat akurasi. Pendekatan Particle Swarm Optimization (PSO) digunakan untuk memilih karakteristik yang tepat untuk menentukan hasil uji kelayakan operasi instalasi listrik karena pemilihan atribut diperlukan dalam analisis data, karena metode PSO akan meningkatkan akurasi dari pada hanya SVM dalam menentukan pemilihan atribut. Jika SVM digunakan dengan PSO, nilai akurasinya adalah 96% dan AUC sebesar 0,994%, sedangkan metode SVM menghasilkan tingkat akurasi sebesar 94,89% dan AUC sebesar 0,994%. Dengan temuan ini, nilai akurasi meningkat sebesar 2%, menjadikannya kategori kategorisasi yang sangat baik. Telah terbukti bahwa penggunaan algoritma berbasis Particle Swarm Optimization (PSO) dapat meningkatkan dan memperbaiki hasil.
Kata kunci: PSO; SVM; Sertifikasi
Abstract:Abstract: Mobile phones, as essential telecommunication devices today, are equipped with numerous features. The plethora of mobile phone models, especially gaming phones, requires consumers to be discerning in choosing a…
phone for everyday use. The problem is that many consumers do not understand how to purchase a phone that meets their specific criteria. The specifications that must be considered when selecting a gaming phone that fits within a budget and meets criteria include performance or specifications, screen quality, battery life, RAM, network connectivity, and price. A decision support system is a part of information systems designed to facilitate decision-making processes based on data or common everyday problems. The Weighted Product (WP) method is typically used in decision-making that involves multiple criteria to be considered simultaneously. Based on the WP method calculations, it was found that the recommended smartphone alternative is determined by the highest vector value (V) ranking according to user-defined criteria. The analysis results indicate that the recommended smartphone alternative is Alternative 1 with a score of 0.376, which is the Infinix GT 10 Pro, due to its comparable specifications to other models but with a more affordable price."
Keywords: decision support systems ; gaming cellphone; recommendation
Abstrak: Handphone sebagai perangkat telekomunikasi yang menjadi kebutuhan utama saat ini sudah dilengkapi dengan banyak fitur. Banyaknya keluaran jenis handphone khususnya handphone untuk game membuat konsumen harus pintar memilih handphone yang dapat digunakan setiap harinya Permasalahannya adalah konsumen banyak yang tidak paham bagaimana membeli handphone sesuai kriteria yang cocok. Adapun spesifikasi yang harus di saat akan memilih jenis handphone game yang sesuai dengan budget dan kriteria diantaranya adalah perfoma atau spesifikasi, tingkat kualitas layar, daya tahan batrai, RAM, koneksi jaringan, dan harga. Sistem pendukung keputusan merupakan bagian dari sistem informasi yang digunakan untuk memudahkan proses pengambilan keputusan berdasarkan data atau permasalahan yang sering ditemui dalam kehidupan sehari-hari. Metode Weighted Product umumnya digunakan dalam pengambilan keputusan yang melibatkan banyak kriteria yang harus dipertimbangkan secara bersamaan. Berdasarkan proses perhitungan dengan metode WP maka didapatkan bahwa alternatif smartphone yang direkomendasikan untuk dipilih adalah smartphone yang ditentukan berdasarkan peringkat nilai vektor (V) tertinggi sesuai dengan kriteria yang ditetapkan oleh pengguna. Hasil analisis menunjukkan bahwa alternatif smartphone yang direkomendasikan adalah Alternatif 1 dengan skor 0.376, yaitu Infinix GT 10 Pro karena memiliki spesifikasi yang hampir setara dengan yang lain namun dengan harga yang lebih terjangkau.
Kata kunci: handphone game; sistem penunjang keputusan; rekomendasi
Abstract:Abstract: Twitter occupies the top position of the most popular social media platform in Indonesia. Police and other related issues were the subject of much discussion. The aim of this research is to analyze public sentiment…
ment towards the National Police Agency using Twitter with the support vector machine method. The research started by crawling Twitter data. The data contains a total of 6,925 entries for three keywords. Next, we move on to the preprocessing stage consisting of (cleaning, case folding, tokenization, and filtering). Next is the tf-idf feature extraction stage, finally the classification and evaluation stage. The results of manual data inspection (73:27) showed accuracy of 70.66%, precision of 70.68%, and recall of 99.76%. Testing the second data (82:18), found accuracy 86%, precision 86.21%, recall 99.71%. The results of manual data checking (82:18) showed accuracy of 70.66%, precision of 70.68%, recall of 99.76%. Testing the second data (82:18), found accuracy 86%, precision 86.21%, recall 99.71%. From the data system testing results (80:20), accuracy was 87.55%, positive precision 87.53%, negative precision 88.24%, positive recall 99.48%, and negative recall. the rate is 99.48.% – The result is 21.43%. Data testing results (60:40) showed accuracy of 86.89%, positive precision of 86.84%, negative precision of 88.46%, positive recall of 99.61%, and negative recall of 16.43%. Single test data validation system (80:20), accuracy 87.55, overall test cross validation system (k fold 5 accuracy) 86.673%.
Keywords: data mining;police agencies;support vector machines
Abstrak: Twitter menduduki posisi teratas platform media sosial terpopuler di Indonesia. Polisi dan masalah terkait lainnya menjadi pokok bahasan banyak pembicaraan. Tujuan penelitian ini untuk menganalisis sentimen masyarakat terhadap Badan Kepolisian Nasional menggunakan Twitter dengan metode support vector machine. Penelitian dimulai dengan crawling data Twitter. Data memuat total 6.925 entri dari tiga kata kunci. Selanjutnya beralih ke tahap preprocessing terdiri dari (pembersihan, pelipatan kasus, tokenisasi, dan pemfilteran). Selanjutnya tahap ekstraksi fitur tf-idf, terakhir tahap klasifikasi dan evaluasi. Hasil pemeriksaan data manual (73:27) menunjukkan akurasi 70,66%, presisi 70,68%, dan recall 99,76%. Menguji data kedua (82:18), menemukan akurasi 86%, presisi 86,21%, recall 99,71%. Hasil pemeriksaan data secara manual (82:18) menunjukkan akurasi 70,66%, presisi 70,68%, recall 99,76%. Menguji data kedua (82:18), menemukan akurasi 86%, presisi 86,21%, recall 99,71%. Dari hasil pengujian sistem data (80:20), akurasi 87,55%, presisi positif 87,53%, presisi negatif 88,24%, recall positif 99,48%, dan recall negatif. tarifnya adalah 99,48.% – Hasilnya 21,43%. Hasil pengujian data (60:40) menunjukkan akurasi 86,89%, presisi positif 86,84%, presisi negatif 88,46%, recall positif 99,61%, dan recall negatif 16,43%. Uji tunggal sistem validasi data (80:20), akurasi 87,55, uji keseluruhan sistem validasi silang (akurasi k fold 5) 86,673%.
Kata Kunci: data mining;instansi kepolisian;mesin vektor pendukung
Abstract:Abstract: Recognizing one's interests and talents early on is crucial in guiding an individual toward a prosperous future. While distinct, interests and talents share a close relationship. Interest denotes a genuine attraction…
action to something without external pressure, and when consistently nurtured, it evolves into a skill or talent. Machine learning, specifically utilizing the SVM algorithm with the RBF kernel, can be applied to categorize interests and talents. Prior to SVM modeling, conducting Exploratory Data Analysis (EDA) is imperative for scrutinizing interests and talents. This analysis facilitates the identification of variables, enabling the elimination of missing values and ensuring the selection of appropriate interest and talent variables. The primary objective is to achieve optimal accuracy in modeling the classification of interests and talents. The insights gained from this research contribute to the creation of an application designed for categorizing interests and talents within SDN XYZ school. This application is designed for student use, assisting them in making informed decisions about their future education and career paths
Keywords: exploratory data analysis; interests and talents; machine learning; SVM Algorithm
Abstrak: Mengenali minat dan bakat seseorang sejak dini sangat penting dalam membimbing individu menuju masa depan yang sukses. Meskipun berbeda, minat dan bakat memiliki hubungan yang erat. Minat mengindikasikan ketertarikan yang tulus terhadap sesuatu tanpa tekanan eksternal, dan ketika terus-menerus dibina, berkembang menjadi keterampilan atau bakat. Pembelajaran mesin, khususnya dengan menggunakan algoritma SVM dan kernel RBF, dapat digunakan untuk mengelompokkan minat dan bakat. Sebelum pemodelan SVM, melakukan Analisis Data Eksploratif (EDA) sangat penting untuk mengkaji minat dan bakat. Analisis ini memfasilitasi identifikasi variabel, memungkinkan penghilangan nilai yang hilang, dan memastikan pemilihan variabel minat dan bakat yang tepat. Tujuan utamanya adalah mencapai akurasi optimal dalam pemodelan klasifikasi minat dan bakat. Temuan dari penelitian ini berkontribusi pada pengembangan aplikasi yang ditujukan untuk mengkategorikan minat dan bakat di sekolah SDN XYZ. Aplikasi ini dirancang untuk digunakan oleh siswa, membantu mereka membuat keputusan yang terinformasi mengenai pendidikan dan karier masa depan mereka.
Kata kunci: Algoritma SVM; exploratory data analysis; machine learning; minat dan bakat