Abstract:Abstract: The determination of thesis topics is a fundamental stage in academic research, yet the evaluation process remains predominantly manual and subjective. This reliance on individual lecturer perception often leads…
s to inconsistent feasibility assessments and fails to systematically measure the topic's alignment with strategic needs. This research aims to develop a Decision Support System (DSS) model based on fuzzy logic to assess the feasibility of thesis topics objectively and systematically, focusing on enhancing the relevance of student research. The research method employed the Fuzzy Inference System (FIS) with the Sugeno method. This model was designed through literature review and FGD to establish four criteria (Topic Relevance, Difficulty Level, Idea Novelty, Reference Availability) and 81 rule bases. The model validation results against expert judgment using 15 test data showed a high accuracy rate of 91.31%, with a Mean Absolute Percentage Error (MAPE) value of 8.69%. In conclusion, this DSS model is proven to be valid and consistent, and it can be relied upon as an objective tool to improve the quality and relevance of thesis topics.
Keywords: academic evaluation; decision support system; fuzzy logic; fuzzy sugeno; thesis feasibility
Abstrak: Penentuan topik skripsi merupakan tahapan fundamental dalam penelitian akademik, namun proses evaluasinya hingga kini masih cenderung manual dan subjektif. Ketergantungan pada persepsi dosen secara individu sering kali menyebabkan penilaian kelayakan yang tidak konsisten serta kegagalan dalam mengukur keselarasan topik dengan kebutuhan strategis secara sistematis. Penelitian ini bertujuan mengembangkan model Sistem Pendukung Keputusan (SPK) berbasis logika fuzzy untuk menilai kelayakan topik skripsi secara objektif dan sistematis, dengan fokus pada peningkatan relevansi penelitian mahasiswa. Metode penelitian yang digunakan adalah Fuzzy Inference System (FIS) dengan metode Sugeno. Model ini dirancang melalui tinjauan pustaka dan Focus Group Discussion (FGD) untuk menetapkan empat kriteria (Relevansi Topik, Tingkat Kesulitan, Kebaruan Ide, Ketersediaan Referensi) serta 81 basis aturan. Hasil validasi model terhadap penilaian pakar menggunakan 15 data uji menunjukkan tingkat akurasi yang tinggi yaitu 91,31%, dengan nilai Mean Absolute Percentage Error (MAPE) sebesar 8,69%. Kesimpulannya, model SPK ini terbukti valid dan konsisten, serta dapat diandalkan sebagai alat objektif untuk meningkatkan kualitas dan relevansi topik skripsi.
Kata kunci: evaluasi akademik; sistem pendukung keputusan; logika fuzzy; fuzzy sugeno; kelayakan skripsi
Abstract:Abstract: Obesity is an escalating global health concern, with unhealthy lifestyle patterns contributing significantly to its development. This study aims to evaluate and compare three clustering techniques for categorizing…
ing lifestyle patterns and obesity-related factors: K-Means, Agglomerative Clustering, and Gaussian Mixture Model (GMM). The data used in this study is sourced from the Food Nutrition dataset, which includes variables such as dietary habits, physical activity, and socio-economic status. The three clustering methods were assessed using evaluation metrics such as Silhouette Score, Davies-Bouldin Index (DBI), and Calinski-Harabasz Index (CHI). The findings revealed that K-Means exhibited the best performance in terms of cluster separation with a Silhouette Score of 0.5559, while GMM showed better flexibility in handling more complex data. Although Agglomerative Clustering produced acceptable results, it had a higher overlap between clusters compared to the other methods. This study offers valuable insights into selecting the most appropriate clustering technique based on the data characteristics.
Keywords: agglomerative; clustering; GMM; k-means; lifestyle patterns; obesity
Abstrak: Obesitas menjadi masalah kesehatan yang semakin meningkat di seluruh dunia, dengan pola hidup yang tidak sehat berperan besar dalam perkembangannya. Penelitian ini bertujuan untuk membandingkan tiga metode clustering dalam mengelompokkan pola gaya hidup dan faktor yang memengaruhi obesitas, yaitu K-Means, Agglomerative Clustering, dan Gaussian Mixture Model (GMM). Data yang digunakan diperoleh dari dataset Food Nutrition yang mencakup informasi terkait pola makan, aktivitas fisik, serta faktor sosial-ekonomi. Ketiga metode tersebut diuji dengan menggunakan beberapa metrik evaluasi, seperti Silhouette Score, Davies-Bouldin Index (DBI), dan Calinski-Harabasz Index (CHI). Hasil penelitian menunjukkan bahwa K-Means memiliki kinerja terbaik dalam hal pemisahan klaster, dengan nilai Silhouette Score sebesar 0.5559, sementara GMM lebih fleksibel dalam menangani data yang lebih kompleks. Meskipun Agglomerative Clustering memberikan hasil yang dapat diterima, tumpang tindih antar klaster lebih besar dibandingkan dengan kedua metode lainnya. Penelitian ini memberikan pemahaman yang lebih baik mengenai pemilihan metode clustering yang tepat berdasarkan karakteristik data yang digunakan.
Kata kunci: agglomerative; clustering; GMM; k-means; obesitas; pola gaya hidup
Abstract:Abstract: Dazry Harapan Household Industry (IRT) is an SME in Jambi City specializing in the production of laundry perfume and previously relied on manual record-keeping using notebooks. This conventional method created…
several issues, including frequent stock recording errors, difficulties in preparing financial reports, delays in identifying minimum stock levels, and the absence of structured historical data. This study aims to develop a web-based digital recording system to improve efficiency, accuracy, and transparency in inventory management. The system was developed using the Agile (Scrum) methodology through three sprints covering the creation of login modules, stock and transaction recording, reporting, minimum-stock notifications, and interface refinement. System design was formulated using use case diagrams, flowcharts, database modeling, and interface prototypes based on the Laravel framework. User Acceptance Testing (UAT) demonstrated high user satisfaction, with 90% of respondents stating that the system is easy to use, 85% reporting faster administrative processes, and 95% acknowledging improved reporting accuracy. The system also increased recording efficiency by 66%—from 3 minutes to 1 minute per transaction—and reduced stock recording errors from 15% to 2% per month. The results indicate that implementing a web-based digital recording system significantly enhances the operational performance of SMEs.
Keywords: SMEs, digital recording system, Agile, inventory management, Laravel.
Abstrak: Industri Rumah Tangga (IRT) Dazry Harapan merupakan UMKM di Kota Jambi yang bergerak pada produksi parfum laundry dan masih menggunakan sistem pencatatan manual berbasis buku tulis. Metode konvensional tersebut menimbulkan berbagai permasalahan, seperti tingginya kesalahan pencatatan stok, hambatan dalam penyusunan laporan keuangan, keterlambatan identifikasi stok minimum, serta ketiadaan rekap data historis yang terstruktur. Penelitian ini bertujuan mengembangkan sistem pencatatan digital berbasis web untuk meningkatkan efisiensi, akurasi, dan transparansi manajemen persediaan. Pengembangan dilakukan menggunakan metode Agile (Scrum) melalui tiga sprint yang mencakup pembangunan modul login, pencatatan stok, transaksi, laporan, notifikasi stok minimum, serta penyempurnaan antarmuka. Desain sistem dirumuskan menggunakan use case diagram, flowchart, perancangan database, dan prototipe antarmuka berbasis Laravel. Hasil pengujian melalui User Acceptance Test (UAT) menunjukkan tingkat penerimaan pengguna yang tinggi, yaitu 90% menilai sistem mudah digunakan, 85% merasakan percepatan proses pencatatan, dan 95% menilai laporan yang dihasilkan lebih akurat. Efisiensi waktu pencatatan meningkat sebesar 66%, dari 3 menit menjadi 1 menit per transaksi, sedangkan tingkat kesalahan pencatatan menurun dari 15% menjadi 2% per bulan. Penelitian ini membuktikan bahwa implementasi sistem pencatatan digital berbasis web mampu meningkatkan kualitas operasional UMKM secara signifikan.
Kata kunci: UMKM; sistem pencatatan digital; Agile; manajemen stok; Laravel;
Abstract:Abstract: SMP Muhammadiyah 5 Samarinda still relies on manual evaluation with limited data analysis tools in predicting student academic achievement. This study aims develop a system for predicting the learning achievement…
nt of students at SMP Muhammadiyah 5 Samarinda using the Naive Bayes classification method. The dataset used consists of 192 student exam scores covering academic scores, attendance, parents’ education and income, and living conditions as independent variables, while the dependent variable is the achievement label (achieved or not achieved). The preprocessing stage includes label normalization, feature selection, and median imputation to handle missing data. The dataset was divided into 75% training data and 25%. The model was implemented as a pipeline consisting of a median imputer and a Gaussian Naive Bayes classifier. The evaluation results showed that the model achieved an accuracy of 79.2%, with a perfect recall value (1.00) in the high-achieving class and (0.64) in the low-achieving class. This shows that the model is quite effective in identifying high-achieving students. The trained model was then integrated into a Flask-based web application, which enables online predictions through a simple form interface, facilitating contextual interpretation. This system is expected to assist in educational decision-making by helping teachers identify students’ achievement levels early on and design more targeted learning interventions.
Keywords: academic performance; educational data mining; naive bayes; prediction system; student achievement
Abstrak: SMP Muhammadiyah 5 Samarinda masih bergantung pada evaluasi manual dengan alat analisis data terbatas dalam melakukan prediksi prestasi akademik siswa. Penelitian ini bertujuan mengembangkan sistem prediksi prestasi belajar siswa SMP Muhammadiyah 5 Samarinda menggunakan metode klasifikasi Naive Bayes. Dataset yang digunakan terdiri atas 192 data nilai ujian siswa yang mencakup skor akademik, kehadiran, pendidikan dan pendapatan orang tua, serta kondisi tempat tinggal sebagai variabel independen, sedangkan variabel dependen berupa label prestasi (berprestasi atau tidak berprestasi). Tahap preprocessing meliputi normalisasi label, seleksi fitur, serta imputasi median untuk menangani data yang hilang. Dataset dibagi menjadi 75% data latih dan 25%. Model diimplementasikan dalam bentuk pipeline yang terdiri atas median imputer dan Gaussian Naive Bayes classifier. Hasil evaluasi menunjukkan bahwa model mencapai akurasi sebesar 79,2%, dengan nilai recall sempurna (1,00) pada kelas berprestasi dan lebih rendah (0,64) pada kelas tidak berprestasi. Hal ini menunjukkan bahwa model cukup efektif dalam mengidentifikasi siswa berprestasi. Model yang telah dilatih kemudian diintegrasikan ke dalam aplikasi web berbasis Flask, yang memungkinkan prediksi secara daring melalui antarmuka formulir sederhana untuk mendukung interpretasi kontekstual. Sistem ini diharapkan dapat membantu untuk pengambilan keputusan dalam pendidikan dengan membantu guru mengidentifikasi tingkat prestasi siswa sejak dini dan merancang intervensi pembelajaran yang lebih terarah.
Kata kunci: prestasi akademik; penambangan data Pendidikan; naive bayes; sistem prediksi; prestasi siswa
Abstract:Abstract: Manual management of domain validity periods and SSL certificates is prone to human error and can cause service disruptions, as was the case at PT XYZ. A reactive approach that relies on vendor notifications has…
s proven to be insufficient to ensure operational continuity. This research aims to design and implement an automated monitoring system to transform this manual approach into a preventive and proactive security framework. The method used is the implementation of an open-source stack consisting of Prometheus to collect metrics from specialized exporters (Blackbox and Domain Exporter), and Grafana for informative centralized dashboard visualization. The system is also integrated with early warning notifications via Telegram for rapid incident response. The result is a functional system with a centralized dashboard that visually displays the remaining validity period of assets using color markers (green for safe status, yellow for early warning, and red for critical status). System testing showed very high accuracy, reaching 100% for domains (MAE 0 days) and 99.45% for SSL certificates (MAE 1.0 days). This system has successfully transformed manual processes into automated and preventive ones, significantly mitigating the risk of human error and ensuring the reliability of digital services.
Keywords: domain; grafana; monitoring; prometheus; SSL certificate.
Abstrak: Pengelolaan manual masa berlaku domain dan sertifikat SSL rentan terhadap human error dan dapat menyebabkan gangguan layanan, seperti yang pernah terjadi di PT XYZ. Pendekatan reaktif yang mengandalkan notifikasi vendor terbukti tidak lagi memadai untuk menjamin kontinuitas operasional. Penelitian ini bertujuan merancang dan mengimplementasikan sistem pemantauan otomatis untuk mentransformasi pendekatan manual tersebut menjadi kerangka kerja keamanan yang preventif dan proaktif. Metode yang digunakan adalah implementasi stack open-source yang terdiri dari Prometheus untuk mengumpulkan metrik dari exporter spesialis (Blackbox dan Domain Exporter), serta Grafana untuk visualisasi dasbor terpusat yang informatif. Sistem ini juga diintegrasikan dengan notifikasi peringatan dini melalui Telegram untuk respons insiden yang cepat. Hasilnya adalah sebuah sistem fungsional dengan dashboard terpusat yang menampilkan sisa masa berlaku aset secara visual menggunakan penanda warna (hijau untuk status aman, kuning untuk peringatan dini, dan merah untuk status kritis). Pengujian sistem menunjukkan akurasi yang sangat tinggi, mencapai 100% untuk domain (MAE 0 hari) dan 99.45% untuk sertifikat SSL (MAE 1.0 hari). Sistem ini berhasil mengubah proses manual menjadi otomatis dan preventif, secara signifikan memitigasi risiko human error dan menjamin keandalan layanan digital.
Kata kunci: domain; grafana; pemantauan; prometheus; sertifikat SSL.
Abstract:Abstract: The policy to increase the Rural and Urban Land and Building Tax (PBB-P2) in Indonesia often elicits mixed reactions from the public. Some support it because they believe it can strengthen regional fiscal capacity,…
ity, while others reject it because they are concerned that it will increase the economic burden on the community. Understanding public sentiment towards this policy is important for evaluating the effectiveness of the policy and formulating appropriate communication strategies. This study aims to analyze public sentiment towards the PBB-P2 increase policy using data uploaded on Platform X (Twitter). The data were collected through crawling with the keyword “building tax,” then processed through several preprocessing stages before classifying tweets into positive and negative sentiments. Two models were used: Support Vector Machine (SVM) and Bidirectional Long Short-Term Memory (BiLSTM). Results show that SVM outperformed BiLSTM, achieving training accuracy of 99.4% and testing accuracy of 85.9%, with accuracy 0.8595, precision 0.8536, recall 0.8595, and F1-score 0.8449. Meanwhile, BiLSTM achieved training accuracy of 86.9% and testing accuracy of 82.9%, with accuracy 0.8294, precision 0.8150, recall 0.8294, and F1-score 0.8080. These findings suggest SVM is more effective in classifying public sentiment and can support better evaluation of regional tax policies.
Keywords: sentiment analysis; PBB-P2; BiLSTM; SVM; X platform
Abstrak: Kebijakan kenaikan tarif Pajak Bumi dan Bangunan Perdesaan dan Perkotaan (PBB-P2) di In-donesia sering memunculkan beragam reaksi dari masyarakat. Sebagian mendukung karena dianggap dapat memperkuat kapasitas fiskal daerah, sementara lainnya menolak karena kha-watir menambah beban ekonomi masyarakat. Pemahaman terhadap sentimen publik atas ke-bijakan tersebut penting untuk mengevaluasi efektivitas kebijakan dan merumuskan strategi komunikasi yang tepat. Penelitian ini bertujuan menganalisis sentimen masyarakat terhadap kebijakan kenaikan PBB-P2 menggunakan data unggahan di Platform X (Twitter). Data dik-umpulkan melalui proses crawling dengan kata kunci “pajak bangunan” kemudian diproses melalui beberapa tahap preprocessing sebelum diklasifikasikan menjadi sentimen positif dan negatif. Dua model digunakan dalam penelitian ini, yaitu Support Vector Machine (SVM) dan Bidirectional Long Short-Term Memory (BiLSTM). Hasil penelitian menunjukkan bahwa SVM memiliki kinerja lebih baik dibandingkan BiLSTM, dengan akurasi pelatihan 99,4% dan akurasi pengujian 85,9%. Nilai akurasi 0,8595, precision 0,8536, recall 0,8595, dan F1-score 0,8449. Sementara itu, BiLSTM memperoleh akurasi pelatihan 86,9% dan akurasi pengujian 82,9%, dengan akurasi 0,8294, precision 0,8150; recall 0,8294; dan F1-score 0,8080. Temuan ini menunjukkan bahwa SVM lebih efektif dalam mengklasifikasikan sentimen publik serta dapat mendukung evaluasi kebijakan pajak daerah dengan lebih baik.
Kata kunci: analisis sentimen; PBB-P2; BiLSTM; SVM; platform X
Abstract:Abstract: The rapid growth of the digital music industry requires accurate music genre classification systems to enhance user experience in streaming services. This study compares a domain-specific Long Short-Term Memory…
(LSTM) network with three Large Language Models (LLMs)—HuBERT, WavLM, and WAV2Vec 2.0—for Music Genre Classification (MGC). The LSTM model was trained using Mel-spectrograms transformed from the GTZAN dataset, while the LLMs were fine-tuned using a smaller set of raw audio samples due to computational constraints. All models were tested on datasets with identical genre labels to ensure a fair evaluation. Results show that the LSTM model achieved the highest accuracy of 97.10%, outperforming HuBERT (86.00%), WavLM (83.00%), and WAV2Vec 2.0 (80.00%). The LSTM demonstrated superior generalization and stability without overfitting, while the LLMs struggled to differentiate between genres with similar acoustic characteristics. These findings indicate that general-purpose pre-trained models, although powerful, are less effective in music-specific tasks due to domain mismatch. Therefore, incorporating music-specific features and architectures remains essential for achieving higher accuracy and reliability in automatic genre classification systems.
Keywords: audio large language models; comparative deep learning; music genre classification.
Abstrak: Pertumbuhan industri musik digital yang pesat menuntut sistem klasifikasi genre musik yang akurat untuk meningkatkan pengalaman pengguna dalam layanan streaming. Penelitian ini dilatarbelakangi oleh perkembangan pesat model pembelajaran mendalam, khususnya jaringan LSTM dan model bahasa berskala besar LLM seperti HuBERT, WavLM, dan WAV2Vec 2.0, yang telah menunjukkan kemampuan representasi audio yang kuat. Tujuan penelitian ini ini membandingkan jaringan Long Short-Term Memory (LSTM) khusus domain dengan tiga model Large Language Models (LLM)—HuBERT, WavLM, dan WAV2Vec 2.0—untuk tugas Klasifikasi Genre Musik (MGC). Metode penelitian melibatkan pelatihan LSTM menggunakan data Mel-spectrogram hasil transformasi dari dataset GTZAN, sementara LLM disesuaikan (fine-tuning) menggunakan data audio mentah dalam jumlah lebih kecil karena keterbatasan komputasi. Seluruh model diuji pada dataset dengan label genre yang sama untuk memastikan evaluasi yang adil. Hasil penelitian menunjukkan bahwa model LSTM mencapai akurasi tertinggi sebesar 97,10%, sedangkan model HuBERT, WavLM, dan WAV2Vec 2.0 masing-masing memperoleh 86,00%, 83,00%, dan 80,00%. Model LSTM menunjukkan kemampuan generalisasi yang lebih baik tanpa overfitting, sedangkan model LLM cenderung kesulitan membedakan genre dengan karakteristik akustik yang mirip. Kesimpulan penelitian ini adalah ketidaksesuaian domain secara signifikan membatasi performa model umum saat diterapkan pada tugas berbasis musik. Oleh karena itu, penggunaan fitur dan arsitektur khusus musik sangat penting dalam membangun sistem klasifikasi genre yang lebih akurat.
Kata kunci: klasifikasi genre musik; model bahasa besar; perbandingan pembelajaran mendalam.
Abstract:Abstract: Soil moisture is an important factor in determining the watering needs of plants for optimal growth. Therefore, accurate monitoring of soil moisture is necessary. This research aims to design and build a soil moisture…
oisture detection tool based on the Decision Tree algorithm with the support of the YL-69 sensor for humidity measurement and the DHT11 sensor for temperature measurement to increase data accuracy. This system uses NodeMCU ESP8266 as a microcontroller and is integrated with an Android application as a user interface. Sensor interpretation data is analyzed using the Decision Tree algorithm to determine soil conditions (dry, damp or wet). The test results show an accuracy level of 95% from 300 data samples. Thus, this system is able to detect soil moisture effectively and can help increase the efficiency of crop management on a household and commercial agricultural scale.
Keywords: agriculture, android, decision tree algorithm, sensors, soil moisture detection
Abstract:Abstract: MBG is a strategic program of the Prabowo-Gibran administration. This program has become a widely discussed issue in the public. To better understand public perception of this program, sentiment analysis is necessary.…
essary. This study aims to compare the performance of algorithms machine learning SVM, RF, And BERT with preprocessing data analyzing public sentiment of the MBG program in media X. The total dataset for this study was 39,858 out of 42,465 successfully crawled tweets. The research methods included data collection, preprocessing data (cleaning, case folding, word normalization, stopword removal and stemming), feature extraction, model training (fine-tuning), handling class imbalance with SMOTE, and evaluation using accuracy, precision, recall, and f1-score. The research results show that without SMOTE, the best performing models are BERT with 89% accuracy, SVM 87%, and RF 78.4%. After SMOTE, the best algorithms were SVM with 92.94%, BERT with 88.3%, and RF with 86.59%. The results confirmed that SVM is the best algorithm if at leastclass imbalance. BERT is the best algorithm before and after SMOTE, because BERT is more effective in capturing the nuances of language on social media, so BERT is the most recommended in MBG sentiment analysis.
Keywords: sentiment analysis; machine learning; SVM, RF, and BERT
Abstrak: MBG merupakan program strategis pemerintahan Prabowo - Gibran. Program ini menjadi isu yang banyak diperbincangkan publik. Untuk mengetahui lebih dalam persepsi masyrakat tentang program ini, perlu dilakukan analisis sentiment. Penelitian ini bertujuan membandingkan kinerja algoritma machine learning SVM, RF, dan BERT dengan preprocessing data menganalisis sentiment public program MBG di media X. Total dataset penelitian ini adalah 39.858 dari 42.465 tweet yang berhasil di crawling. Metode penelitian mencakup pengumpulan data, preprocessing data (cleaning, case folding, normalisasi kata, stopword removal dan stemming), ekstraksi fitur, pelatihan model (fine-tuning), penanganan class imbalance dengan SMOTE, dan evaluasi menggunakan akurasi, presisi, recall, dan f1-score. Hasil peneltian menunjukkan, tanpa SMOTE model dengan kinerja terbaik adalah BERT dengan akurasi 89%, SVM 87%, dan RF 78,4%. Setelah SMOTE algoritma terbaik adalah SVM 92,94%, BERT 88,3% dan RF 86,59%. Hasil penelitian menegaskan bahwa SVM adalah algoritma terbaik jika minimal class imbalance. BERT adalah algoritma terbaik sebelum dan sesudah SMOTE, karena BERT lebih efektif dalam menangkap nuansa bahasa pada media sosial, sehingga BERT paling di rekomendasikan dalam analisis sentimen MBG.
Kata kunci: analisis sentimen; machine learning; SVM, RF, dan BERT
Abstract:Abstract: Stroke is one of the leading causes of death and disability in various parts of the world, including in Indonesia. Along with the development of digital technology, the use of Machine Learning in the health sector…
tor is growing, one of which is in an effort to predict the occurrence of stroke. This study aims to implement the Logistic Regression algorithm in predicting the likelihood of a person having a stroke based on data from the Brain Stroke dataset. The research process includes data preprocessing (missing value handling, normalization, and label encoding), dividing the data into 80% training data and 20% test data, as well as model training. The model was then evaluated using several measures such as accuracy, precision, recall, F1-score, and ROC-AUC, as well as a confusion matrix. The results of the study showed that Logistic Regression was able to provide stroke classification results with an accuracy of 82.4%, precision of 80.1%, recall of 78.6%, F1-score of 79.3%, and a ROC-AUC value of 0.87. Then, the model is integrated into applications that use Streamlit, so it can be used interactively to predict stroke risk in new data. The results of this study show that the combination of Machine Learning and web-based applications has the potential to support efforts to detect early stroke risk.
Keywords: logistic regression; machine learning; prediction; streamlit; stroke.
Abstrak: Stroke adalah salah satu penyebab utama kematian dan kecacatan di berbagai belahan dunia, termasuk di Indonesia. Seiring perkembangan teknologi digital, penggunaan Machine Learning dalam bidang kesehatan semakin berkembang, salah satunya dalam upaya memprediksi terjadinya penyakit stroke. Penelitian ini bertujuan untuk mengimplementasikan algoritma Logistic Regression dalam memprediksi kemungkinan seseorang mengalami stroke berdasarkan data dari dataset Brain Stroke. Proses penelitian meliputi preprocessing data (penanganan missing value, normalisasi, dan label encoding), membagi data menjadi 80% data latih dan 20% data uji, serta pelatihan model. Model kemudian dievaluasi menggunakan beberapa ukuran seperti akurasi, precision, recall, F1-score, dan ROC-AUC, serta confusion matrix. Hasil penelitian menunjukkan bahwa Logistic Regression mampu memberikan hasil klasifikasi penyakit stroke dengan akurasi sebesar 82,4%, precision 80,1%, recall 78,6%, F1-score 79,3%, dan nilai ROC-AUC sebesar 0,87. Kemudian, model tersebut diintegrasikan ke dalam aplikasi yang menggunakan Streamlit, sehingga dapat digunakan secara interaktif untuk memprediksi risiko stroke pada data baru. Hasil penelitian ini menunjukkan bahwa kombinasi Machine Learning dan aplikasi berbasis web berpotensi mendukung upaya deteksi dini risiko stroke.
Kata kunci: logistic regression; machine learning; prediksi; streamlit; stroke.