Abstract:Abstract: Human metapneumovirus (HMPV) poses a global health threat, but its detection remains challenging due to limited environmental monitoring. This study aims to develop a portable diagnostic tool for rapid HMPV detection…
ection by integrating cutting-edge biotechnology (CRISPR-Cas system and immunoassay) with air quality sensors on an Internet of Things (IoT)-based microfluidic platform controlled by an ESP32 microcontroller. The system is supported by a companion application and data analysis using Vertex AI, and is capable of providing results in less than fifteen minutes. The development results demonstrate the potential for improving detection accuracy and reliability, particularly with further development of virus-specific biosensors, sensor optimization, and algorithms. This technology is effective as a complementary tool for early screening and environment-based risk management in areas with limited laboratory facilities, although it does not completely replace molecular diagnostic methods such as PCR. A rapid diagnostic approach based on environmental sensors, IoT, and artificial intelligence is a promising strategy to improve early HMPV detection, accelerate public health responses, and strengthen respiratory infection prevention through integrated environmental monitoring and education functions.
Keywords: air quality; CRISPR-Cas; Human Metapneumovirus (HMPV); Internet of Things, portable diagnostic; public health; rapid detection; sensors.
Abstrak: Human metapneumovirus (HMPV) merupakan ancaman bagi kesehatan global, namun pendeteksiannya masih sulit akibat keterbatasan pemantauan lingkungan. Studi ini bertujuan mengembangkan alat diagnostik portabel untuk deteksi cepat HMPV melalui integrasi bioteknologi mutakhir (sistem CRISPR-Cas dan immunoassay) dengan sensor kualitas udara pada platform mikrofluida berbasis Internet of Things (IoT) yang dikendalikan mikrokontroler ESP32. Sistem ini didukung aplikasi pendamping dan analisis data menggunakan Vertex AI, serta mampu memberikan hasil dalam waktu kurang dari lima belas menit. Hasil pengembangan menunjukkan potensi peningkatan akurasi dan keandalan deteksi, terutama dengan pengembangan lanjutan berupa biosensor spesifik virus, optimalisasi sensor, dan algoritma. Teknologi ini efektif sebagai alat pelengkap untuk skrining awal dan manajemen risiko berbasis lingkungan di wilayah dengan keterbatasan fasilitas laboratorium, meskipun tidak sepenuhnya menggantikan metode diagnostik molekuler seperti PCR. Pendekatan diagnostik cepat berbasis sensor lingkungan, IoT, dan kecerdasan buatan menjadi strategi menjanjikan untuk meningkatkan deteksi dini HMPV, mempercepat respons kesehatan masyarakat, serta memperkuat pencegahan infeksi saluran pernapasan melalui fungsi pemantauan dan edukasi lingkungan yang terintegrasi.
Kata kunci: CRISPR-Cas; diagnostik portabel; deteksi cepat; Human Metapneumovirus (HMPV); kesehatan masyarakat; IoT (Internet of Things); sensor kualitas udara.
Abstract:Abstract: The rapid development of digital technology has brought significant changes in consumption patterns and customer behavior, particularly in the fashion retail sector. Increasing competition and rising cynsumer expectations…
xpectations for fast, accurate, and technology-based services require businesses to innovate and undergo digital transformation. One widely used approach is the implementation of automation-based Electronic Customer Relationship Management (E-CRM). This study aims to analyze the implementation of E-CRM automation and its impact on service efficiency at Toko Diah Fashion, a fashion retail business that still faces service challenges due to manual systems, such as customer data duplication, delayed responses, and difficulty in monitoring transaction history. The research method used is a descriptive qualitative method with data collection techniques through observation, interviews, and documentation. The research focus is limited to aspects of service efficiency, including service speed, accuracy in managing customer data, and ease in customer follow-up. The E-CRM automation system studied is designed using PHP programming language and a MySQL database. The research results indicate that the implementation of E-CRM automation can significantly improve service efficiency. This system facilitates integrated customer data management, speeds up the service process, and supports more personalized communication through notification features and transaction history recording.
Keyword: automation; e-crm; fashion retail; service efficiency.
Abstrak: Perkembangan teknologi digital yang semakin pesat telah membawa perubahan signifikan dalam pola konsumsi dan perilaku pelanggan, khususnya dalam sektor ritel fashion. Persaingan yang semakin ketat serta meningkatnya ekspektasi konsumen terhadap layanan yang cepat, akurat dan berbasis teknologi menuntut pelaku usaha untuk melakukan inovasi dan transformasi digital. Salah satu pendekatan yang banyak digunakan adalah penerapan Electronic Customer Relationship Management (E-CRM) berbasis automasi. Penelitian ini bertujuan untuk menganalisis penerapan automasi E-CRM serta pengaruhnya terhadap efisiensi pelayanan pada Toko Diah Fashion, sebuah usaha ritel fashion yang masih menghadapi kendala pelayanan akibat sistem manual, seperti duplikasi data pelanggan, keterlambatan respons, dan kesulitan dalam pemantauan histori transaksi. Metode penelitian yang digunakan adalah metode kualitatif deskriptif dengan teknik pengumpulan data melalui observasi, wawancara, dan dokumentasi. Fokus penelitian dibatasi pada aspek efisiensi pelayanan, meliputi kecepatan pelayanan, ketepatan pengelolaan data pelanggan, serta kemudahan dalam tindak lanjut pelanggan. Sistem automasi E-CRM yang dikaji dirancang menggunakan bahasa pemrograman PHP dan basis data MySQL. Hasil penelitian menunjukkan bahwa penerapan automasi E-CRM mampu meningkatkan efisiensi pelayanan secara signifikan. Sistem ini mempermudah pengelolaan data pelanggan secara terintegrasi, mempercepat proses pelayanan, serta mendukung komunikasi yang lebih personal melalui fitur notifikasi dan pencatatan histori transaksi.
Kata kunci: automasi; e-crm; efisiensi pelayanan; ritel fashion.
Abstract:Abstract: The materials sector is one of the stock markets sectors that attracts investors due to the high level of construction activity in Indonesia, which supports long-term growth. Stock price movements are influenced…
d by various factors, requiring investors to determine the appropriate timing for buying, selling, or holding stocks. Therefore, this study aims to predict stock prices in the materials sector using a combination of CNN–BiLSTM algorithms. The research data were obtained from Yahoo Finance and processed through min–max normalization, data splitting, sliding window, model implementation, and evaluation stages. Testing was conducted on INTP and SMGR stocks with data split scenarios ranging from 60:40 to 90:10. The results show that CNN–BiLSTM performs best with a 90:10 data split, with minimum MSE and MAPE values of 0.000153 and 2.471% for INTP, and 0.000199 and 2.208% for SMGR, respectively. These findings indicate that increasing the proportion of training data improves the model's ability to learn historical patterns and produce more stable predictions.
Keywords: CNN-BILSTM; materials sector; stock
Abstrak: Sektor materials merupakan salah satu sektor saham yang diminati investor karena tingginya aktivitas pembangunan di Indonesia yang mendorong pertumbuhan jangka panjang. Pergerakan harga saham dipengaruhi oleh berbagai faktor sehingga investor perlu menentukan waktu transaksi yang tepat. Oleh karena itu, penelitian ini bertujuan memprediksi harga saham sektor materials menggunakan kombinasi algoritma CNN–BiLSTM. Data penelitian diperoleh dari Yahoo Finance dan diproses melalui tahapan normalisasi min–max, pembagian data, sliding window, implementasi model, serta evaluasi. Pengujian dilakukan pada saham INTP dan SMGR dengan skenario pembagian data 60:40 hingga 90:10. Hasil menunjukkan bahwa CNN–BiLSTM menghasilkan performa terbaik pada pembagian data 90:10, dengan nilai MSE dan MAPE minimum masing-masing sebesar 0.000153 dan 2.471% untuk INTP, serta 0.000199 dan 2.208% untuk SMGR. Temuan ini mengindikasikan bahwa peningkatan porsi data latih meningkatkan kemampuan model dalam mempelajari pola historis dan menghasilkan prediksi yang lebih stabil.
Kata kunci: CNN-BILSTM; saham; sektor materials
Abstract:Abstract: Malaria remains a major global health problem, particularly in tropical countries such as Indonesia. Accurate early diagnosis is essential for reducing malaria-related morbidity and mortality. Conventional microscopic…
oscopic examination is time-consuming, highly dependent on expert personnel, and prone to human error. This study compares the performance of two Convolutional Neural Network (CNN) architectures, ResNet-50 and DenseNet-121, for malaria image classification. The Cell Images for Malaria dataset provided by the National Institutes of Health (NIH) through Kaggle was used, consisting of 27,558 microscopic blood cell images categorized into Parasitized and Uninfected classes. The dataset was divided into 80% training data and 20% testing data. Image preprocessing included resizing to 224 × 224 pixels, normalization, labeling, and data augmentation using RandomFlip, RandomRotation, RandomZoom, and RandomContrast. Experimental results showed that the ResNet-50 model trained for 100 epochs achieved the highest performance, with an accuracy of 95.54% and precision, recall, and F1-score of 0.96. The confusion matrix indicated 5,272 correctly classified images out of 5,510 testing samples. These findings demonstrate that ResNet-50 outperformed DenseNet-121 and has strong potential for supporting accurate, reliable, and efficient computer-aided malaria diagnosis based on microscopic blood smear images.
Keywords: computer-aided diagnosis; convolutional neural network (CNN); densenet-121; early detection; image classification; malaria; microscopic blood smear images; resnet-50;
Abstrak : Malaria masih menjadi masalah kesehatan global yang serius, terutama di negara tropis seperti Indonesia. Diagnosis dini yang akurat sangat penting untuk menurunkan angka morbiditas dan mortalitas. Metode konvensional berupa pemeriksaan mikroskopis memiliki keterbatasan karena memerlukan waktu yang relatif lama, bergantung pada tenaga ahli, dan berpotensi menimbulkan kesalahan manusia. Penelitian ini bertujuan membandingkan kinerja arsitektur Convolutional Neural Network (CNN) yaitu ResNet-50 dan DenseNet-121 dalam klasifikasi citra malaria. Dataset yang digunakan berasal dari Cell Images for Malaria yang disediakan oleh National Institutes of Health (NIH) melalui platform Kaggle, terdiri dari 27.558 citra dengan pembagian 80% data latih, 20% data validasi. Tahap praproses meliputi cleaning, resizing citra menjadi 224×224 piksel, normalisasi, labeling, serta data augmentasi menggunakan RandomFlip, RandomRotation, RandomZoom, dan RandomContrast. Hasil pengujian menunjukkan bahwa model ResNet-50 pada epoch 100 memperoleh akurasi sebesar 95,54% dengan nilai precision, recall, dan F1-score masing-masing sebesar 0,96. Confusion matrix menunjukkan jumlah prediksi benar sebanyak 5.272 dari total 5.510 data uji. Hasil ini menunjukkan bahwa arsitektur CNN mampu mengklasifikasikan citra malaria dengan tingkat akurasi yang tinggi dan memiliki kemampuan generalisasi yang baik terhadap data baru. Penelitian ini memberikan kontribusi dalam evaluasi performa arsitektur CNN untuk mendukung pengembangan sistem diagnosis malaria berbasis citra mikroskopis yang lebih cepat dan akurat.
Kata kunci: convolutional neural network (CNN); citra mikroskopis hapusan darah; densenet-121; diagnosis berbantuan komputer; deteksi dini; klasifikasi citra; malaria; resnet-50
Abstract:Abstract: The implementation of dress code regulations in university environments is generally still carried out conventionally, requiring significant time and effort and potentially leading to subjective assessments. This…
is study develops an automatic student dress code compliance detection system using computer vision based on the YOLOv8 model. The dataset consists of 1,800 annotated images divided into eight clothing categories, split into 78% training (1,404 images), 14% validation (254 images), and 8% testing (143 images). All images underwent preprocessing and data augmentation before training the YOLOv8 model with an input size of 640×640 pixels for 50 epochs. During testing, the YOLOv8 model achieved an overall performance of Precision 0.844, Recall 0.773, F1-Score 0.802, and mAP@0.5 0.841, and was able to detect clothing objects with good accuracy and stable performance under various image conditions. The system was integrated with a Flask-based backend and a web-based frontend to enable real time detection and compliance classification, with a response time of less than 2 seconds, supporting automatic and consistent identification of student dress code compliance as “Compliant” or “Violation.”
Keywords: compliance detection; computer vision; dress code regulations; real time detection; YOLOv8.
Abstrak: Penerapan aturan berpakaian di lingkungan kampus umumnya masih dilakukan secara konvensional sehingga membutuhkan waktu dan tenaga yang relatif besar serta berpotensi menimbulkan subjektivitas penilaian. Penelitian ini bertujuan mengembangkan sistem pendeteksi kepatuhan berpakaian mahasiswa secara otomatis berbasis visi komputer menggunakan model YOLOv8. Dataset yang digunakan terdiri dari 1.800 citra beranotasi yang terbagi ke dalam 8 kategori pakaian, dengan pembagian data sebesar 78% data latih (1.404 citra), 14% data validasi (254 citra) dan 8% data uji (143 citra). Seluruh citra diproses melalui tahapan pre-processing dan data augmentation, kemudian digunakan untuk melatih model YOLOv8 dengan ukuran input 640×640 piksel selama 50 epoch. Pada tahap pengujian, model mencapai performa keseluruhan dengan Precision 0.844, Recall 0.773, F1-Score 0.802, dan mAP@0.5 0.841, serta mampu mendeteksi objek pakaian dengan akurasi baik dan performa stabil pada berbagai kondisi citra. Sistem kemudian diintegrasikan dengan backend berbasis Flask dan frontend web untuk mendukung proses deteksi waktu nyata dan klasifikasi kepatuhan, dengan waktu respons sistem kurang dari 2 detik, sehingga mampu mengidentifikasi status kepatuhan berpakaian mahasiswa ke dalam kategori “Aman” dan “Melanggar Aturan” secara otomatis dan konsisten.
Kata kunci: aturan berpakaian; deteksi waktu nyata; pendeteksi kepatuhan; visi komputer; YOLOv8.
Abstract:Abstract: Tourism in Pati Regency currently lacks an integrated digital information system, resulting in suboptimal dissemination of information and trip planning. To address this issue, a tourism website for Pati Regency…
y was developed, equipped with a recommended tourist route feature. This study aims to design and develop a web-based tourism information system that provides destination information based on categories, media galleries, and promotional YouTube videos, as well as a Patiways feature that allows users to select multiple tourist destinations. The system then calculates the most efficient visiting order using a greedy heuristic algorithm, based on the selected starting point. The system was developed using the Waterfall method, consisting of analysis, design, implementation, and testing phases. The system design is illustrated through UML diagrams such as Use Case, Activity, and Class Diagrams. With this system, the distribution of tourism information becomes more effective, and tourists can plan trips with optimized routes. Additionally, the website is expected to serve as a digital promotion medium that contributes to increasing tourist visits to Pati Regency.
Keywords: heuristic greedy; recommendation route; tourism; waterfall
Abstrak: Pariwisata di Kabupaten Pati saat ini belum memiliki sistem informasi digital yang terintegrasi, sehingga penyebaran informasi dan perencanaan perjalanan wisata masih belum optimal. Untuk mengatasi permasalahan tersebut, penelitian ini mengembangkan sebuah website pariwisata Kabupaten Pati yang dilengkapi dengan fitur rekomendasi rute wisata terbaik. Penelitian ini bertujuan untuk merancang dan membangun sistem informasi pariwisata berbasis web yang mampu menyajikan informasi destinasi wisata berdasarkan kategori, galeri media, serta video promosi YouTube. Selain itu, sistem ini dilengkapi dengan fitur unggulan bernama Patiways yang memungkinkan pengguna memilih beberapa destinasi wisata dan secara otomatis memperoleh urutan kunjungan paling efisien menggunakan algoritma heuristik greedy berdasarkan titik awal perjalanan. Pengembangan sistem dilakukan menggunakan metode Waterfall yang meliputi tahapan analisis kebutuhan, perancangan sistem, implementasi, dan pengujian. Perancangan sistem direpresentasikan menggunakan diagram UML, meliputi Use Case Diagram, Activity Diagram, dan Class Diagram. Dengan adanya sistem ini, diharapkan penyebaran informasi pariwisata menjadi lebih efektif, wisatawan dapat merencanakan perjalanan dengan rute yang optimal, serta website dapat berfungsi sebagai media promosi digital yang berkontribusi terhadap peningkatan kunjungan wisatawan ke Kabupaten Pati.
Kata kunci: heuristik greedy; pariwisata; rekomendasi rute; waterfall
Abstract:Abstract: One of the main challenges in digital image processing is limited resolution, which makes it difficult to preserve visual details when images are enlarged. Conventional methods such as Bilinear Interpolation are…
e commonly used for image upscaling; however, these approaches often produce blurred images, lose fine textures, and fail to reconstruct complex visual structures. This study aims to enhance digital image resolution by employing a deep learni based approach using a Low-Light Convolutional Neural Network (LLCNN) built upon a Deep Neural Network (DNN) architecture. The dataset used in this study is the DIV2K dataset, which consists of 1,000 high-resolution images. These images were downsampled using scaling factors of ×2, ×3, and ×4 to generate paired Low Resolution–High Resolution (LR–HR) data for training and evaluation. The proposed LLCNN is designed to extract important features such as edges, textures, and local patterns through multiple convolutional layers, followed by non-linear mapping to reconstruct high-resolution images more accurately. Quantitative performance evaluation was conducted using the Peak Signal-to-Noise Ratio (PSNR) and the Structural Similarity Index (SSIM). Model performance was evaluated quantitatively using the Peak Signal-to-Noise Ratio (PSNR) metric. Experimental results showed that the proposed method improved image quality compared to the bilinear method. These results indicate that the deep learning based approach effectively improves image sharpness and structural fidelity, thereby demonstrating its potential for digital image resolution enhancement.
Keywords: deep neural network; image resolution; low-light convolutional neural network; machine learning
Abstrak: Permasalahan utama dalam pengolahan citra digital adalah keterbatasan resolusi yang menyebabkan detail visual sulit dipertahankan ketika citra diperbesar. Metode konvensional seperti Bilinear Interpolation masih banyak digunakan, namun sering menghasilkan citra buram, kehilangan tekstur halus, serta tidak mampu merekonstruksi struktur visual yang kompleks. Penelitian ini bertujuan untuk meningkatkan kualitas resolusi citra digital dengan memanfaatkan pendekatan deep learning berbasis Low-Light Convolutional Neural Network (LLCNN) yang dibangun di atas arsitektur Deep Neural Network (DNN). Data yang digunakan dalam penelitian ini berasal dari dataset DIV2K, yang terdiri dari 1000 citra beresolusi tinggi. Citra tersebut diturunkan menjadi resolusi rendah menggunakan faktor downsampling ×2, ×3, dan ×4 untuk membentuk pasangan data Low Resolution–High Resolution (LR–HR) sebagai data pelatihan dan pengujian. LLCNN dirancang untuk mengekstraksi fitur-fitur penting seperti tepi, tekstur, dan pola lokal melalui beberapa lapisan konvolusi, kemudian melakukan pemetaan non-linear guna merekonstruksi citra resolusi tinggi secara lebih presisi. Evaluasi performa model dilakukan secara kuantitatif menggunakan metrik Peak Signal-to-Noise Ratio (PSNR). Hasil eksperimen menunjukkan bahwa metode yang diusulkan mampu meningkatkan kualitas citra dibandingkan metode bilinear. Hasil ini membuktikan bahwa pendekatan berbasis deep learning efektif dalam meningkatkan ketajaman dan kesesuaian struktur citra digital.
Kata kunci: deep neural network; low-light convolutional neural network; machine learning; resolusi citra
Abstract:Abstract: The capital market plays an important role in describing the economic conditions of a country, and the IHSG is used as the main indicator to observe the movement of all stocks on the Indonesia Stock Exchange. Because…
ecause stock data is volatile and non-linear, the forecasting process becomes challenging, requiring methods that can capture historical patterns more accurately. This study aims to predict IHSG movements using the Long Short-Term Memory (LSTM) model to generate stable short-term predictions. Historical IHSG data was used to train the model, and accuracy was evaluated using Mean Squared Error (MSE). The results show that the model obtained an MSE 6784.0207, RMSE 82.3652 and MAPE 0.88%, indicating a relatively low prediction error rate. The visualization shows that the model's predictions are very close to the actual data, and the 60-day forecasting results show a potential increase in the IHSG of 1.05%. Thus, the LSTM model is capable of providing fairly accurate IHSG predictions and can be a useful tool for investors in analyzing short-term market movements.
Keywords: forecasting; JCI; long short term memory
Abstrak: Pasar modal memiliki peran penting dalam menggambarkan kondisi ekonomi suatu negara, dan IHSG digunakan sebagai indikator utama untuk melihat pergerakan seluruh saham di Bursa Efek Indonesia. Karena data saham bersifat fluktuatif dan tidak linear, proses peramalan menjadi tantangan, sehingga dibutuhkan metode yang mampu menangkap pola historis secara lebih akurat. Penelitian ini bertujuan memprediksi pergerakan IHSG menggunakan model Long Short-Term Memory (LSTM) untuk menghasilkan prediksi jangka pendek yang stabil. Data historis IHSG digunakan untuk melatih model, kemudian akurasi dievaluasi menggunakan Mean Squared Error (MSE). Hasil penelitian menunjukkan bahwa model memperoleh nilai MSE 6784.0207, RMSE 82.3652 dan MAPE 0.88% yang menandakan tingkat kesalahan prediksi relatif rendah. Visualisasi menunjukkan bahwa prediksi model sangat mendekati data aktual, dan hasil forecasting 60 hari ke depan memperlihatkan potensi kenaikan IHSG sebesar 1,05%. Dengan demikian, model LSTM mampu memberikan prediksi IHSG yang cukup akurat dan dapat menjadi alat bantu bagi investor dalam menganalisis pergerakan pasar jangka pendek.
Kata kunci: peramalan; JCI; memori jangka pendek
Abstract:Abstract: Dazry Harapan Household Industry (IRT) is an SME in Jambi City specializing in the production of laundry perfume and previously relied on manual record-keeping using notebooks. This conventional method created…
several issues, including frequent stock recording errors, difficulties in preparing financial reports, delays in identifying minimum stock levels, and the absence of structured historical data. This study aims to develop a web-based digital recording system to improve efficiency, accuracy, and transparency in inventory management. The system was developed using the Agile (Scrum) methodology through three sprints covering the creation of login modules, stock and transaction recording, reporting, minimum-stock notifications, and interface refinement. System design was formulated using use case diagrams, flowcharts, database modeling, and interface prototypes based on the Laravel framework. User Acceptance Testing (UAT) demonstrated high user satisfaction, with 90% of respondents stating that the system is easy to use, 85% reporting faster administrative processes, and 95% acknowledging improved reporting accuracy. The system also increased recording efficiency by 66%—from 3 minutes to 1 minute per transaction—and reduced stock recording errors from 15% to 2% per month. The results indicate that implementing a web-based digital recording system significantly enhances the operational performance of SMEs.
Keywords: SMEs, digital recording system, Agile, inventory management, Laravel.
Abstrak: Industri Rumah Tangga (IRT) Dazry Harapan merupakan UMKM di Kota Jambi yang bergerak pada produksi parfum laundry dan masih menggunakan sistem pencatatan manual berbasis buku tulis. Metode konvensional tersebut menimbulkan berbagai permasalahan, seperti tingginya kesalahan pencatatan stok, hambatan dalam penyusunan laporan keuangan, keterlambatan identifikasi stok minimum, serta ketiadaan rekap data historis yang terstruktur. Penelitian ini bertujuan mengembangkan sistem pencatatan digital berbasis web untuk meningkatkan efisiensi, akurasi, dan transparansi manajemen persediaan. Pengembangan dilakukan menggunakan metode Agile (Scrum) melalui tiga sprint yang mencakup pembangunan modul login, pencatatan stok, transaksi, laporan, notifikasi stok minimum, serta penyempurnaan antarmuka. Desain sistem dirumuskan menggunakan use case diagram, flowchart, perancangan database, dan prototipe antarmuka berbasis Laravel. Hasil pengujian melalui User Acceptance Test (UAT) menunjukkan tingkat penerimaan pengguna yang tinggi, yaitu 90% menilai sistem mudah digunakan, 85% merasakan percepatan proses pencatatan, dan 95% menilai laporan yang dihasilkan lebih akurat. Efisiensi waktu pencatatan meningkat sebesar 66%, dari 3 menit menjadi 1 menit per transaksi, sedangkan tingkat kesalahan pencatatan menurun dari 15% menjadi 2% per bulan. Penelitian ini membuktikan bahwa implementasi sistem pencatatan digital berbasis web mampu meningkatkan kualitas operasional UMKM secara signifikan.
Kata kunci: UMKM; sistem pencatatan digital; Agile; manajemen stok; Laravel;
Abstract:Abstract: The rapid growth of the digital music industry requires accurate music genre classification systems to enhance user experience in streaming services. This study compares a domain-specific Long Short-Term Memory…
(LSTM) network with three Large Language Models (LLMs)—HuBERT, WavLM, and WAV2Vec 2.0—for Music Genre Classification (MGC). The LSTM model was trained using Mel-spectrograms transformed from the GTZAN dataset, while the LLMs were fine-tuned using a smaller set of raw audio samples due to computational constraints. All models were tested on datasets with identical genre labels to ensure a fair evaluation. Results show that the LSTM model achieved the highest accuracy of 97.10%, outperforming HuBERT (86.00%), WavLM (83.00%), and WAV2Vec 2.0 (80.00%). The LSTM demonstrated superior generalization and stability without overfitting, while the LLMs struggled to differentiate between genres with similar acoustic characteristics. These findings indicate that general-purpose pre-trained models, although powerful, are less effective in music-specific tasks due to domain mismatch. Therefore, incorporating music-specific features and architectures remains essential for achieving higher accuracy and reliability in automatic genre classification systems.
Keywords: audio large language models; comparative deep learning; music genre classification.
Abstrak: Pertumbuhan industri musik digital yang pesat menuntut sistem klasifikasi genre musik yang akurat untuk meningkatkan pengalaman pengguna dalam layanan streaming. Penelitian ini dilatarbelakangi oleh perkembangan pesat model pembelajaran mendalam, khususnya jaringan LSTM dan model bahasa berskala besar LLM seperti HuBERT, WavLM, dan WAV2Vec 2.0, yang telah menunjukkan kemampuan representasi audio yang kuat. Tujuan penelitian ini ini membandingkan jaringan Long Short-Term Memory (LSTM) khusus domain dengan tiga model Large Language Models (LLM)—HuBERT, WavLM, dan WAV2Vec 2.0—untuk tugas Klasifikasi Genre Musik (MGC). Metode penelitian melibatkan pelatihan LSTM menggunakan data Mel-spectrogram hasil transformasi dari dataset GTZAN, sementara LLM disesuaikan (fine-tuning) menggunakan data audio mentah dalam jumlah lebih kecil karena keterbatasan komputasi. Seluruh model diuji pada dataset dengan label genre yang sama untuk memastikan evaluasi yang adil. Hasil penelitian menunjukkan bahwa model LSTM mencapai akurasi tertinggi sebesar 97,10%, sedangkan model HuBERT, WavLM, dan WAV2Vec 2.0 masing-masing memperoleh 86,00%, 83,00%, dan 80,00%. Model LSTM menunjukkan kemampuan generalisasi yang lebih baik tanpa overfitting, sedangkan model LLM cenderung kesulitan membedakan genre dengan karakteristik akustik yang mirip. Kesimpulan penelitian ini adalah ketidaksesuaian domain secara signifikan membatasi performa model umum saat diterapkan pada tugas berbasis musik. Oleh karena itu, penggunaan fitur dan arsitektur khusus musik sangat penting dalam membangun sistem klasifikasi genre yang lebih akurat.
Kata kunci: klasifikasi genre musik; model bahasa besar; perbandingan pembelajaran mendalam.