Abstract:Abstract: The rapid growth of e-commerce mobile applications has generated large volumes of user reviews, making manual sentiment analysis increasingly impractical. This study aims to compare the effectiveness of three machine…
achine learning algorithms Support Vector Machine (SVM), Random Forest, and Naive Bayes for automated sentiment classification of Indonesian-language mobile application reviews. A dataset of 3,000 user reviews from the RupaRupa application on the Google Play Store was collected and preprocessed through normalization, tokenization, stopword removal, and stemming. TF-IDF vectorization was applied for feature extraction, while the Synthetic Minority Over-sampling Technique (SMOTE) was used to address class imbalance across three sentiment categories: positive, negative, and neutral. The results show that SVM achieved the highest accuracy of 90.02%, while Random Forest obtained the best F1-score of 88.08% when sufficient training data were available. Naive Bayes demonstrated relatively stable performance across varying training data sizes. Furthermore, TF-IDF keyword analysis revealed that negative reviews were primarily associated with delivery issues, technical problems, and pricing concerns. These findings demonstrate the effectiveness of machine learning approaches for sentiment classification and provide practical insights for improving mobile application services.
Keywords: sentiment analysis; machine learning; SMOTE; TF-IDF; text classification
Abstrak: Pertumbuhan pesat aplikasi mobile e-commerce telah menghasilkan volume ulasan pengguna yang sangat besar, sehingga analisis sentimen secara manual menjadi semakin tidak praktis. Penelitian ini bertujuan untuk membandingkan efektivitas tiga algoritma machine learning Support Vector Machine (SVM), Random Forest, dan Naive Bayes dalam melakukan klasifikasi sentimen otomatis terhadap ulasan aplikasi mobile berbahasa Indonesia. Dataset yang digunakan terdiri dari 3.000 ulasan pengguna aplikasi RupaRupa yang dikumpulkan dari Google Play Store. Data kemudian diproses melalui tahapan preprocessing yang meliputi normalisasi, tokenisasi, penghapusan stopword, dan stemming. Ekstraksi fitur dilakukan menggunakan metode Term Frequency–Inverse Document Frequency (TF-IDF), sedangkan ketidakseimbangan kelas ditangani menggunakan Synthetic Minority Over-sampling Technique (SMOTE) pada tiga kategori sentimen, yaitu positif, negatif, dan netral. Hasil penelitian menunjukkan bahwa SVM mencapai tingkat akurasi tertinggi sebesar 90,02%, sementara Random Forest memperoleh nilai F1-score terbaik sebesar 88,08% ketika tersedia data pelatihan yang memadai. Naive Bayes menunjukkan performa yang relatif stabil pada berbagai ukuran data pelatihan. Selain itu, analisis kata kunci berbasis TF-IDF mengungkapkan bahwa ulasan negatif terutama berkaitan dengan masalah pengiriman, kendala teknis aplikasi, dan isu harga. Temuan ini menunjukkan bahwa pendekatan machine learning efektif untuk klasifikasi sentimen serta memberikan wawasan yang bermanfaat dalam meningkatkan kualitas layanan aplikasi mobile.
Kata Kunci: analisis sentimen; pembelajaran mesin; SMOTE; TF-IDF; klasifikasi teks.
Abstract:Abstract: Managing fast-moving drug inventory requires accurate supplier selection to ensure product availability and minimize the risk of overstock and out-of-stock conditions. At Annisa Pharmacy, the supplier selection…
process has traditionally relied on experience and subjective judgment, which may lead to less optimal decisions. This study aims to design and implement a Decision Support System (DSS) for selecting fast-moving drug suppliers using the Weighted Product (WP) method. The WP method is applied because it is capable of processing multiple criteria simultaneously through structured weighting, including demand frequency, delivery lead time, remaining shelf life, purchase price, and profit margin. The system is developed as a web-based application using PHP and MySQL. The results show that the implementation of the Weighted Product method successfully produces preference values and accurate supplier rankings, enabling the system to correctly determine the most optimal fast-moving drug supplier based on the defined criteria. Therefore, the developed system can assist the owner of Annisa Pharmacy in making more precise, objective, and structured inventory procurement decisions.
Keywords: decision support system; drug inventory; supplier selection; weighted product.
Abstrak: Pengelolaan stok obat fast moving di Toko Obat Annisa memerlukan ketepatan dalam menentukan supplier agar ketersediaan obat tetap terjaga dan risiko overstock maupun out of stock dapat diminimalkan. Selama ini, proses pemilihan supplier masih dilakukan secara konvensional berdasarkan pengalaman, sehingga berpotensi menghasilkan keputusan yang kurang optimal. Penelitian ini bertujuan untuk merancang dan mengimplementasikan Sistem Pendukung Keputusan (SPK) pemilihan supplier obat fast moving menggunakan metode Weighted Product (WP). Metode WP digunakan karena mampu mengolah beberapa kriteria secara simultan melalui pembobotan yang terstruktur, meliputi frekuensi permintaan, lead time, sisa masa kedaluwarsa, harga beli, dan margin keuntungan. Sistem dikembangkan berbasis web menggunakan bahasa pemrograman PHP dan basis data MySQL. Hasil penelitian menunjukkan bahwa penerapan metode Weighted Product mampu menghasilkan nilai preferensi dan perankingan supplier secara objektif, sehingga sistem berhasil menentukan supplier obat fast moving yang paling optimal sesuai dengan kriteria yang telah ditetapkan. Dengan demikian, sistem yang dibangun dapat membantu pemilik Toko Obat Annisa dalam mengambil keputusan pengadaan stok obat secara lebih tepat, objektif, dan terstruktur.
Kata kunci: sistem pendukung keputusan; toko obat; pemilihan pemasok; weighted product
Abstract:Abstract: The election of the Student Council President is an important process in building a democratic, responsible, and integrity-based leadership culture in the school environment. In addition, through the main discussion…
ssion in this study aims to optimize the selection process for candidates for Student Council President at SMP Negeri 11 Tanjung Balai through the implementation of a Decision Support System (DSS) based on the MOORA (Multi-Objective Optimization on the Basis of Ratio Analysis) method. The MOORA method is used to normalize values, weight criteria, and calculate optimization values to produce the best alternative ranking. Data were obtained through observation, interviews with school officials, and literature studies. The results of the study indicate that the MOORA method is able to provide objective and transparent ranking results, where M. Asril Sitorus Pane obtained the highest score of 0.347 (Rank 1), followed by M. Rian with a score of 0.333 (Rank 2). The implementation of this system is expected to be able to provide recommendations for the best candidates regularly and accurately, so that it can support fairer and more accountable decision-making in the next Student Council President election.
Keywords: decision support system; osis chairman election; MOORA; SMP negeri 11 tanjung balai.
Abstrak: Pemilihan Ketua OSIS merupakan proses penting dalam membangun budaya kepemimpinan yang demokratis, bertanggung jawab dan berintegritas di lingkungan sekolah. Selain itu, melalui pokok pembahasan pada penelitian ini bertujuan untuk dapat mengoptimalkan proses seleksi calon Ketua OSIS di SMP Negeri 11 Tanjung Balai melalui penerapan Sistem Pendukung Keputusan berbasis metode MOORA (Multi-Objective Optimization on the Basis of Ratio Analysis). Metode MOORA digunakan agar dapat melakukan normalisasi nilai, pembobotan kriteria serta perhitungan nilai optimasi guna menghasilkan peringkat alternatif terbaik. Data diperoleh melalui observasi, wawancara dengan pihak sekolah serta dan studi kepustakaan. Hasil penelitian menunjukkan bahwa metode MOORA mampu memberikan hasil peringkat yang objektif dan transparan, yang dimana M. Asril Sitorus Pane memperoleh nilai tertinggi sebesar 0,347 (Peringkat 1), diikuti oleh M. Rian dengan nilai 0,333 (Peringkat 2). Penerapan sistem ini diharapkan mampu memberikan rekomendasi kandidat terbaik secara sistematis dan akurat, sehingga dapat mendukung pengambilan keputusan yang lebih adil dan akuntabel dalam pemilihan Ketua OSIS selanjutnya.
Kata kunci: MOORA; pemilihan ketua osis; sistem pendukung keputusan; SMP negeri 11 tanjung balai.
Abstract:Abstract: Inventory management of consumable medical devices and drugs plays a crucial role in maintaining the continuity of healthcare operations. However, Jelita Dental Care still faces challenges in recording and controlling…
rolling stock due to manual procedures, which can lead to data inaccuracy, procurement delays, and the risk of stockouts. To address these issues, this study aims to develop a web-based Electronic Supply Chain Management (E-SCM) system that integrates stock monitoring and procurement processes. The Reorder Point (ROP) method is applied to determine the optimal reorder point based on average demand, lead time, and safety stock. This system was built using the PHP programming language and MySQL database. The results show that the JelitaMed system is able to improve the effectiveness and accuracy of inventory management, simplify the structured procurement submission process between the admin, owner, and supplier, and support decision-making in maintaining the availability of consumable medical devices and drugs. Thus, the implementation of E-SCM combined with the ROP method is a practical solution to improve inventory control in small-scale health clinics.
Keywords: e-scm; inventory; information system; medical supplies; reorder point.
Abstrak: Pengelolaan persediaan alat dan obat medis habis pakai memiliki peran penting dalam menjaga keberlangsungan operasional layanan kesehatan. Namun, Jelita Dental Care masih menghadapi kendala dalam pencatatan dan pengendalian stok akibat prosedur manual, yang dapat menyebabkan ketidaktepatan data, keterlambatan pengadaan, serta risiko kekurangan persediaan. Untuk mengatasi permasalahan tersebut, penelitian ini bertujuan mengembangkan sistem Electronic Supply Chain Management (E-SCM) berbasis web yang mengintegrasikan pemantauan stok dan proses pengadaan. Metode Reorder Point (ROP) diterapkan untuk menentukan waktu pemesanan ulang yang optimal berdasarkan permintaan rata-rata, lead time, dan safety stock. Sistem ini dibangun menggunakan bahasa pemrograman PHP dan database MySQL. Hasil penelitian menunjukkan bahwa sistem JelitaMed mampu meningkatkan efektivitas dan akurasi pengelolaan persediaan, mempermudah proses pengajuan pengadaan secara terstruktur antara admin, owner, dan supplier, serta mendukung pengambilan keputusan dalam menjaga ketersediaan alat dan obat medis habis pakai. Dengan demikian, penerapan E-SCM yang dikombinasikan dengan metode ROP menjadi solusi praktis untuk meningkatkan pengendalian persediaan pada klinik kesehatan skala kecil.
Kata kunci: alat medis; e-scm; persediaan; reorder point; sistem informasi
Abstract:Abstract: This research is motivated by the problem of building material inventory management at Jaqfar Building Store, which is still done manually and based on subjective estimates. This often results in inaccuracies in…
n determining stock levels, either in the form of overstock or understock, which hinders operational effectiveness. The purpose of this study is to apply the Multiple Linear Regression method to analyze the relationship between incoming stock (X1) and outgoing stock (X2) variables with the ending stock variable (Y) to produce an optimal inventory prediction model. The research methodology used includes collecting historical transaction data for building materials such as cement, ceramics, zinc, plywood, and iron. This web-based prediction system was developed using the PHP programming language and a MySQL database. The analysis results show that the resulting regression model can provide a mathematical picture of future inventory patterns based on historical data. Implementation of this system is expected to assist the management of Jaqfar Building Materials Store in making strategic decisions regarding purchasing and sales in a more measured and efficient manner.
Keyword: building materials; data mining; inventory; multiple linear regression
Abstrak: Penelitian ini dilatarbelakangi oleh permasalahan pengelolaan persediaan bahan bangunan di Toko Bangunan Jaqfar yang masih dilakukan secara manual dan berdasarkan perkiraan subjektif. Hal ini menyebabkan sering terjadinya ketidaktepatan dalam menentukan jumlah stok, baik berupa kelebihan barang (overstock) maupun kekurangan barang (understock) yang menghambat efektivitas operasional. Tujuan dari penelitian ini adalah menerapkan metode Multiple Linear Regression (Regresi Linear Berganda) untuk menganalisis hubungan antara variabel stok masuk (X1) dan stok keluar (X2) terhadap variabel stok akhir (Y) guna menghasilkan model prediksi persediaan yang optimal. Metodologi penelitian yang digunakan mencakup pengumpulan data historis transaksi bahan bangunan seperti semen, keramik, seng, triplek, dan besi. Sistem prediksi ini dikembangkan berbasis web menggunakan bahasa pemrograman PHP dan basis data MySQL. Hasil analisis menunjukkan bahwa model regresi yang dihasilkan mampu memberikan gambaran matematis mengenai pola persediaan di masa mendatang berdasarkan data historis. Implementasi sistem ini diharapkan dapat membantu manajemen Toko Bangunan Jaqfar dalam mengambil keputusan strategis terkait pembelian dan penjualan secara lebih terukur serta efisien.
Kata kunci: bahan bangunan; data mining; persediaan; regresi linear berganda
Abstract:Abstract: The rapid development of digital technology has brought significant changes in consumption patterns and customer behavior, particularly in the fashion retail sector. Increasing competition and rising cynsumer expectations…
xpectations for fast, accurate, and technology-based services require businesses to innovate and undergo digital transformation. One widely used approach is the implementation of automation-based Electronic Customer Relationship Management (E-CRM). This study aims to analyze the implementation of E-CRM automation and its impact on service efficiency at Toko Diah Fashion, a fashion retail business that still faces service challenges due to manual systems, such as customer data duplication, delayed responses, and difficulty in monitoring transaction history. The research method used is a descriptive qualitative method with data collection techniques through observation, interviews, and documentation. The research focus is limited to aspects of service efficiency, including service speed, accuracy in managing customer data, and ease in customer follow-up. The E-CRM automation system studied is designed using PHP programming language and a MySQL database. The research results indicate that the implementation of E-CRM automation can significantly improve service efficiency. This system facilitates integrated customer data management, speeds up the service process, and supports more personalized communication through notification features and transaction history recording.
Keyword: automation; e-crm; fashion retail; service efficiency.
Abstrak: Perkembangan teknologi digital yang semakin pesat telah membawa perubahan signifikan dalam pola konsumsi dan perilaku pelanggan, khususnya dalam sektor ritel fashion. Persaingan yang semakin ketat serta meningkatnya ekspektasi konsumen terhadap layanan yang cepat, akurat dan berbasis teknologi menuntut pelaku usaha untuk melakukan inovasi dan transformasi digital. Salah satu pendekatan yang banyak digunakan adalah penerapan Electronic Customer Relationship Management (E-CRM) berbasis automasi. Penelitian ini bertujuan untuk menganalisis penerapan automasi E-CRM serta pengaruhnya terhadap efisiensi pelayanan pada Toko Diah Fashion, sebuah usaha ritel fashion yang masih menghadapi kendala pelayanan akibat sistem manual, seperti duplikasi data pelanggan, keterlambatan respons, dan kesulitan dalam pemantauan histori transaksi. Metode penelitian yang digunakan adalah metode kualitatif deskriptif dengan teknik pengumpulan data melalui observasi, wawancara, dan dokumentasi. Fokus penelitian dibatasi pada aspek efisiensi pelayanan, meliputi kecepatan pelayanan, ketepatan pengelolaan data pelanggan, serta kemudahan dalam tindak lanjut pelanggan. Sistem automasi E-CRM yang dikaji dirancang menggunakan bahasa pemrograman PHP dan basis data MySQL. Hasil penelitian menunjukkan bahwa penerapan automasi E-CRM mampu meningkatkan efisiensi pelayanan secara signifikan. Sistem ini mempermudah pengelolaan data pelanggan secara terintegrasi, mempercepat proses pelayanan, serta mendukung komunikasi yang lebih personal melalui fitur notifikasi dan pencatatan histori transaksi.
Kata kunci: automasi; e-crm; efisiensi pelayanan; ritel fashion.
Abstract:Abstract: This study discusses the optimization of RAG for a FAQ system in the field of information technology product security certification at BSSN. Although LLM generate reliable responses, they often lack up-to-date…
and domain-specific knowledge, which can be addressed through the RAG approach. This research aims to optimize a domain-specific RAG system by improving embedding performance, enhancing prompt robustness, and increasing retrieval accuracy. The research methods consist of three stages. The first stage involves fine-tuning the bge-m3 embedding model and evaluating its performance using MRR, Recall, and AUC. The second stage applies prompt engineering techniques, namely the SRSM and Autodefense, to mitigate direct-injection and escape-character prompt injection attacks. The third stage evaluates the proposed RAG system using Precision, Recall, and F1-Score metrics against four baseline models. The results of research show that the fine-tuned embedding model achieves higher performance than the original model, with MRR@1 and Recall@1 values of 0.80 and an AUC@100 of 0.7023. In addition, the proposed prompt engineering techniques demonstrate robustness against prompt injection attacks, while the overall RAG system attains a perfect Precision, Recall, and F1-Score of 1.00. In conclusion, the proposed approach effectively enhances retrieval accuracy, embedding quality, and system security, resulting in a more reliable RAG-based FAQ system for information technology product security certification.
Keywords: embedding fine-tuning; large language model; prompt engineering; prompt injection mitigation; retrieval-augmented generation
Abstrak: Studi ini membahas optimasi RAG untuk sistem FAQ di bidang sertifikasi keamanan produk teknologi informasi di BSSN. Meskipun LLM menghasilkan respons yang andal, mereka seringkali kurang memiliki pengetahuan terkini dan spesifik domain, yang dapat diatasi melalui pendekatan RAG. Penelitian ini bertujuan untuk mengoptimalkan sistem RAG spesifik domain dengan meningkatkan kinerja embedding, meningkatkan ketahanan prompt dan meningkatkan akurasi pengambilan. Metode penelitian terdiri dari tiga tahap. Tahap pertama melibatkan fine-tuning model embedding bge-m3 dan mengevaluasi kinerjanya menggunakan Mean Reciprocal Rank (MRR), Recall, dan AUC. Tahap kedua menerapkan teknik rekayasa prompt, yaitu Self- SRSM dan Autodefense, untuk mengurangi serangan direct-injection dan escape-character prompt injection. Tahap ketiga mengevaluasi sistem RAG yang diusulkan menggunakan metrik Presisi, Recall, dan F1-Score terhadap empat model dasar. Hasil penelitian menunjukkan bahwa model embedding yang disempurnakan mencapai kinerja yang lebih tinggi daripada model asli, dengan nilai MRR@1 dan Recall@1 sebesar 0,80 dan AUC@100 sebesar 0,7023. Selain itu, teknik rekayasa prompt yang diusulkan menunjukkan ketahanan terhadap serangan injeksi prompt, sementara sistem RAG secara keseluruhan mencapai Presisi, Recall, dan F1-Score sempurna sebesar 1,00. Kesimpulannya, pendekatan yang diusulkan secara efektif meningkatkan akurasi pengambilan, kualitas embedding dan keamanan sistem, menghasilkan sistem FAQ berbasis RAG yang lebih andal untuk sertifikasi keamanan produk teknologi informasi.
Kata kunci: penyempurnaan embedding; model bahasa besar; rekayasa prompt; mitigasi injeksi prompt; retrieval-augmented generation
Abstract:Deteksi emosi secara fine-grained pada teks media sosial merupakan salah satu tantangan dalam bidang pemrosesan bahasa alami (Natural Language Processing/NLP), terutama karena sifat data yang tidak terstruktur dan multi-label.…
label. Penelitian ini bertujuan untuk mengevaluasi performa tiga model berbasis arsitektur Transformer, yaitu EmoBERT, RoBERTa, dan EmoRoBERTa, dalam tugas klasifikasi emosi pada teks dari dataset SenWave. Dataset ini terdiri dari 10.001 tweet berbahasa Inggris yang telah dilabeli ke dalam sepuluh kategori emosi, namun penelitian ini berfokus pada empat label utama: anxious, annoyed, empathetic, dan sad. Proses penelitian meliputi prapemrosesan data, tokenisasi, pembagian data latih dan uji, pelatihan model, serta evaluasi menggunakan metrik akurasi, presisi, recall, dan f1-score. Hasil evaluasi menunjukkan bahwa model EmoBERT dan EmoRoBERTa memiliki performa terbaik dengan nilai f1-score sebesar 0,81, sedangkan RoBERTa memperoleh nilai f1-score sebesar 0,73. Temuan ini menunjukkan bahwa penyesuaian arsitektur Transformer khusus untuk emosi dapat meningkatkan akurasi klasifikasi emosi pada teks media sosial.
Abstract:Abstract: The rapid growth of the digital music industry requires accurate music genre classification systems to enhance user experience in streaming services. This study compares a domain-specific Long Short-Term Memory…
(LSTM) network with three Large Language Models (LLMs)—HuBERT, WavLM, and WAV2Vec 2.0—for Music Genre Classification (MGC). The LSTM model was trained using Mel-spectrograms transformed from the GTZAN dataset, while the LLMs were fine-tuned using a smaller set of raw audio samples due to computational constraints. All models were tested on datasets with identical genre labels to ensure a fair evaluation. Results show that the LSTM model achieved the highest accuracy of 97.10%, outperforming HuBERT (86.00%), WavLM (83.00%), and WAV2Vec 2.0 (80.00%). The LSTM demonstrated superior generalization and stability without overfitting, while the LLMs struggled to differentiate between genres with similar acoustic characteristics. These findings indicate that general-purpose pre-trained models, although powerful, are less effective in music-specific tasks due to domain mismatch. Therefore, incorporating music-specific features and architectures remains essential for achieving higher accuracy and reliability in automatic genre classification systems.
Keywords: audio large language models; comparative deep learning; music genre classification.
Abstrak: Pertumbuhan industri musik digital yang pesat menuntut sistem klasifikasi genre musik yang akurat untuk meningkatkan pengalaman pengguna dalam layanan streaming. Penelitian ini dilatarbelakangi oleh perkembangan pesat model pembelajaran mendalam, khususnya jaringan LSTM dan model bahasa berskala besar LLM seperti HuBERT, WavLM, dan WAV2Vec 2.0, yang telah menunjukkan kemampuan representasi audio yang kuat. Tujuan penelitian ini ini membandingkan jaringan Long Short-Term Memory (LSTM) khusus domain dengan tiga model Large Language Models (LLM)—HuBERT, WavLM, dan WAV2Vec 2.0—untuk tugas Klasifikasi Genre Musik (MGC). Metode penelitian melibatkan pelatihan LSTM menggunakan data Mel-spectrogram hasil transformasi dari dataset GTZAN, sementara LLM disesuaikan (fine-tuning) menggunakan data audio mentah dalam jumlah lebih kecil karena keterbatasan komputasi. Seluruh model diuji pada dataset dengan label genre yang sama untuk memastikan evaluasi yang adil. Hasil penelitian menunjukkan bahwa model LSTM mencapai akurasi tertinggi sebesar 97,10%, sedangkan model HuBERT, WavLM, dan WAV2Vec 2.0 masing-masing memperoleh 86,00%, 83,00%, dan 80,00%. Model LSTM menunjukkan kemampuan generalisasi yang lebih baik tanpa overfitting, sedangkan model LLM cenderung kesulitan membedakan genre dengan karakteristik akustik yang mirip. Kesimpulan penelitian ini adalah ketidaksesuaian domain secara signifikan membatasi performa model umum saat diterapkan pada tugas berbasis musik. Oleh karena itu, penggunaan fitur dan arsitektur khusus musik sangat penting dalam membangun sistem klasifikasi genre yang lebih akurat.
Kata kunci: klasifikasi genre musik; model bahasa besar; perbandingan pembelajaran mendalam.
Abstract:Abstract: MBG is a strategic program of the Prabowo-Gibran administration. This program has become a widely discussed issue in the public. To better understand public perception of this program, sentiment analysis is necessary.…
essary. This study aims to compare the performance of algorithms machine learning SVM, RF, And BERT with preprocessing data analyzing public sentiment of the MBG program in media X. The total dataset for this study was 39,858 out of 42,465 successfully crawled tweets. The research methods included data collection, preprocessing data (cleaning, case folding, word normalization, stopword removal and stemming), feature extraction, model training (fine-tuning), handling class imbalance with SMOTE, and evaluation using accuracy, precision, recall, and f1-score. The research results show that without SMOTE, the best performing models are BERT with 89% accuracy, SVM 87%, and RF 78.4%. After SMOTE, the best algorithms were SVM with 92.94%, BERT with 88.3%, and RF with 86.59%. The results confirmed that SVM is the best algorithm if at leastclass imbalance. BERT is the best algorithm before and after SMOTE, because BERT is more effective in capturing the nuances of language on social media, so BERT is the most recommended in MBG sentiment analysis.
Keywords: sentiment analysis; machine learning; SVM, RF, and BERT
Abstrak: MBG merupakan program strategis pemerintahan Prabowo - Gibran. Program ini menjadi isu yang banyak diperbincangkan publik. Untuk mengetahui lebih dalam persepsi masyrakat tentang program ini, perlu dilakukan analisis sentiment. Penelitian ini bertujuan membandingkan kinerja algoritma machine learning SVM, RF, dan BERT dengan preprocessing data menganalisis sentiment public program MBG di media X. Total dataset penelitian ini adalah 39.858 dari 42.465 tweet yang berhasil di crawling. Metode penelitian mencakup pengumpulan data, preprocessing data (cleaning, case folding, normalisasi kata, stopword removal dan stemming), ekstraksi fitur, pelatihan model (fine-tuning), penanganan class imbalance dengan SMOTE, dan evaluasi menggunakan akurasi, presisi, recall, dan f1-score. Hasil peneltian menunjukkan, tanpa SMOTE model dengan kinerja terbaik adalah BERT dengan akurasi 89%, SVM 87%, dan RF 78,4%. Setelah SMOTE algoritma terbaik adalah SVM 92,94%, BERT 88,3% dan RF 86,59%. Hasil penelitian menegaskan bahwa SVM adalah algoritma terbaik jika minimal class imbalance. BERT adalah algoritma terbaik sebelum dan sesudah SMOTE, karena BERT lebih efektif dalam menangkap nuansa bahasa pada media sosial, sehingga BERT paling di rekomendasikan dalam analisis sentimen MBG.
Kata kunci: analisis sentimen; machine learning; SVM, RF, dan BERT