Search Articles & Publications

Showing 3669 articles found for "Menggunakan"

INTELLIGENT DIGITAL FORENSICS FILE MANIPULATION DETECTION USING METADATA ANALYSIS AND RANDOM FOREST

Panggabean, Erwin Gabe, Perwira, Yuda, Parulian Sinaga, Dedi Candro, Lidia Lubis , Nur, Suheru, Muhammad
Abstract: Abstract: The advancement of digital technology has made it easier to create, process, and distribute files—using 317 files from the dataset https://www.kaggle.com/datasets/axon data/selfie-and-official-id-photo-dataset-18k… t-18k images?select=metadata_image.csv has also introduced new challenges, such as the increasing practice of digital file manipulation that is difficult to detect visually. Therefore, an intelligent digital forensics system that can automatically and accurately detect file authenticity is required. This study aims to develop an intelligent digital forensics system for detecting file manipulation by leveraging metadata analysis and the Random Forest classification method. The methods used include extracting metadata from digital files—such as time information, device details, and processing history—followed by analysis to identify patterns of inconsistency that indicate manipulation. This data is then used as features in the classification process using the Random Forest algorithm to distinguish between original and manipulated files. The results of this study are expected to show that the use of metadata analysis combined with the Random Forest algorithm can improve accuracy in detecting digital file manipulation compared to conventional methods. The resulting system is expected to provide an effective, efficient, and integrated solution to support digital forensic investigations, Based on the test results, the system demonstrated good performance with an accuracy rate of 94%.   Keywords: Digital Forensics;File Manipulation;Metadata Analysis;Random Forest;Classification;Machine Learning   Abstrak:Perkembangan teknologi digital telah meningkatkan kemudahan dalam pembuatan, pengolahan,dan distribusi file sebanyak 317 file, sumber datasets https:// www.kaggle.com/datasets/axondata/selfie-and-official-id-photo-dataset-18k-images?select =metadata_image.csv, namun juga menimbulkan tantangan baru berupa meningkatnya praktik manipulasi file digital yang sulit dideteksi secara kasat mata. Oleh karena itu, diperlukan suatu sistem forensik digital yang cerdas dan mampu mendeteksi keaslian file secara otomatis dan akurat. Penelitian ini bertujuan untuk mengembangkan sistem forensik digital cerdas untuk deteksi manipulasi file dengan memanfaatkan analisis metadata dan metode klasifikasi Random Forest. Metode yang digunakan meliputi proses ekstraksi metadata dari file digital, seperti informasi waktu, perangkat, dan riwayat pengolahan, kemudian dilakukan analisis untuk menemukan pola ketidaksesuaian yang mengindikasikan adanya manipulasi. Selanjutnya, data tersebut digunakan sebagai fitur dalam proses klasifikasi menggunakan algoritma Random Forest untuk membedakan antara file asli dan file yang telah dimanipulasi. Hasil dari penelitian ini diharapkan menunjukkan bahwa penggunaan analisis metadata yang dikombinasikan dengan algoritma Random Forest mampu meningkatkan akurasi dalam mendeteksi manipulasi file digital dibandingkan metode konvensional. Sistem yang dihasilkan dapat memberikan solusi yang efektif, efisien, dan terintegrasi dalam mendukung proses investigasi forensik digital, Berdasarkan hasil pengujian, sistem menunjukkan performa yang baik dengan tingkat akurasi sebesar 94%.   Kata Kunci: Forensik Digital, Manipulasi File, Metadata, Random Forest, Klasifikasi, Machine Learning.

DEVELOPMENT OF A DIGITAL E-CRM AS A SOLUTION FOR CUSTOMER RELATIONSHIP MANAGEMENT AND TRANSACTION ACTIVITIES AT TOKO ZUMA

Nurul Azzuma, Afdhal Syafnur, Rahayu, Elly
Abstract: Abstract: Toko Zuma faces challenges in optimizing customer relationship management and transaction recording due to conventional manual systems, which hinder real-time loyalty monitoring and sales analysis. This research… h aims to design a digital Electronic Customer Relationship Management (E-CRM) system as an integrative solution for systematic and centralized management. The design method employs Unified Modeling Language (UML) for requirements analysis, user interface design, and Black-box Testing for validation. Results demonstrate a 100% success rate across all primary modules. The platform features Point Reward, automated transaction management, and live chat for direct interaction. Implementation enables personalized promotional strategies based on accurate data to increase customer retention. In conclusion, the Digital E-CRM system effectively automates business processes, serving as a strategic instrument for transparent and measurable customer relationship management. Keywords: digital e-crm; relationship management; toko zuma; transaction activities.     Abstrak: Toko Zuma menghadapi kendala dalam optimalisasi manajemen hubungan pelanggan dan pencatatan transaksi karena masih menggunakan sistem manual konvensional. Penelitian ini bertujuan merancang sistem Electronic Customer Relationship Management (E-CRM) digital sebagai solusi integratif untuk pengelolaan basis data dan transaksi secara terpusat. Metode perancangan meliputi analisis kebutuhan menggunakan Unified Modeling Language (UML), desain antarmuka, dan validasi fungsional melalui Black-box Testing. Hasil pengujian menunjukkan tingkat keberhasilan 100% pada seluruh modul utama. Platform ini dilengkapi fitur Point Reward, manajemen transaksi otomatis, dan media interaksi live chat. Implementasi sistem ini memungkinkan strategi promosi personal berdasarkan data akurat untuk meningkatkan retensi pelanggan. Simpulannya, sistem E-CRM digital berhasil mengotomatisasi proses bisnis dan menjadi instrumen strategis dalam manajemen hubungan pelanggan yang transparan dan terukur. Kata kunci: aktivitas transaksi; digital e-crm; pengelolaan relasi; toko zuma.

PERFORMANCE EVALUATION OF AUTOMATED MEETING SUMMARIZATION BASED ON OPEN AI WHISPER AND INDOT5 FINE-TUNING

Lanang Oka Wiyana, I Gusti, Indah Ciptayani, Putu, Adisimakrisna Peling, Ida Bagus
Abstract: Abstract: Manual meeting documentation risks losing important information due to cognitive fatigue. Although automated summarization models have evolved, integrated end-to-end systems for Indonesian spoken language remain… n highly limited. This study aims to design and evaluate an end-to-end automated meeting summarization architecture that directly integrates Automatic Speech Recognition (ASR) via OpenAI Whisper for transcription and the IndoT5 language model for abstractive summarization. IndoT5 was fine-tuned using a dataset of 486 Indonesian spoken language transcript pairs. Testing was conducted on a CPU infrastructure using MP4, MP3, and WAV formats. Results show the optimal fine-tuning configuration significantly improved accuracy, achieving ROUGE-1 (0.4167), ROUGE-2 (0.1973), and ROUGE-L (0.2701) scores. Computationally, the system achieved a Real-Time Factor below 1, processing data faster than the actual recording duration. Conclusively, integrating Whisper and IndoT5 shows potential in producing coherent meeting summaries with lightweight computational overhead, making it viable for local infrastructure implementation to ensure data privacy. Keywords: abstractive summarization; ASR; end-to-end pipeline; IndoT5; real-time factor     Abstrak: Dokumentasi rapat manual rentan menghilangkan informasi penting akibat keterbatasan kognitif. Meskipun model peringkas otomatis telah berkembang, implementasi sistem terintegrasi (end-to-end) khusus percakapan lisan berbahasa Indonesia masih sangat terbatas. Penelitian ini bertujuan merancang dan mengevaluasi arsitektur peringkas rapat otomatis end-to-end yang mengintegrasikan langsung Automatic Speech Recognition (ASR) melalui OpenAI Whisper untuk transkripsi dan model bahasa IndoT5 untuk peringkasan abstraktif. Adaptasi domain dilakukan melalui fine-tuning IndoT5 menggunakan 486 pasang dataset transkrip lisan berbahasa Indonesia. Pengujian pada infrastruktur CPU menggunakan format MP4, MP3, dan WAV. Hasil pengujian menunjukkan konfigurasi fine-tuning optimal berhasil meningkatkan akurasi, dengan skor ROUGE-1 (0,4167), ROUGE-2 (0,1973), dan ROUGE-L (0,2701). Sistem mendemonstrasikan efisiensi komputasi dengan nilai Real-Time Factor di bawah 1, mengindikasikan waktu pemrosesan lebih cepat dari durasi rekaman asli. Kesimpulannya, integrasi Whisper dan IndoT5 menunjukkan potensi dalam menghasilkan ringkasan yang koheren dengan beban komputasi ringan, sehingga layak diimplementasikan pada infrastruktur lokal organisasi untuk menjaga privasi data. Kata kunci: ASR; end-to-end pipeline; IndoT5; peringkasan abstraktif; real-time factor  

AHP - SAW DECISION SUPPORT SYSTEM FOR AI-BASED TEACHING MATERIAL RECOMMENDATION

Amin, Muhammad, Rasyid, Hainur, Akmal, Akmal
Abstract: Abstract: The development of Artificial Intelligence (AI) in education provides significant opportunities for supporting the development of English teaching materials in elementary schools. However, the wide variety of available… vailable AI tools makes it difficult for teachers to select the most appropriate tools for their instructional needs. This study aims to analyze and generate recommendations for AI utilization using a Decision Support System (DSS) based on the Analytical Hierarchy Process (AHP) and Simple Additive Weighting (SAW) methods. The AHP method is used to determine the weight of criteria based on their importance, while the SAW method is applied to rank alternative AI tools. This study involves teachers at SDN 15 Padang Genting in identifying criteria and evaluating alternatives. The results show that the proposed DSS model is capable of generating appropriate AI tool recommendations based on predefined criteria. This approach contributes to more objective and systematic decision-making in utilizing AI for developing English teaching materials in elementary education. Keywords: analytical hierarchy proces; artificial intelligence; decision support system; simple additive weighting; teaching materials   Abstrak: Perkembangan Artificial Intelligence (AI) dalam pendidikan memberikan peluang dalam penyusunan bahan ajar Bahasa Inggris di sekolah dasar. Namun, banyaknya pilihan tools AI menyebabkan guru mengalami kesulitan dalam menentukan tools yang paling sesuai dengan kebutuhan pembelajaran. Penelitian ini bertujuan untuk menganalisis dan menghasilkan rekomendasi pemanfaatan AI menggunakan Sistem Pendukung Keputusan (SPK) berbasis metode Analytical Hierarchy Process (AHP) dan Simple Additive Weighting (SAW). Metode AHP digunakan untuk menentukan bobot kriteria berdasarkan tingkat kepentingannya, sedangkan metode SAW digunakan untuk melakukan perangkingan alternatif tools AI. Penelitian ini melibatkan guru di SDN 15 Padang Genting dalam proses identifikasi kriteria dan penilaian alternatif. Hasil penelitian menunjukkan bahwa model SPK mampu menghasilkan rekomendasi tools AI yang sesuai dengan kebutuhan pengguna berdasarkan kriteria yang telah ditentukan. Pendekatan ini memberikan kontribusi dalam mendukung pengambilan keputusan yang lebih objektif dan sistematis dalam pemanfaatan AI untuk penyusunan bahan ajar Bahasa Inggris di sekolah dasar. Kata kunci: analisis proses hierarki; bahan ajar; kecerdasan buatan; sistem pendukung keputusan; simple additive weighting.

TOPSIS-BASED SYSTEM FOR THE SELECTION OF TRAINING PARTICIPANT CANDIDATES AT THE ASAHAN MANPOWER OFFICE

Maha Putra, Guntur, Wan Mariatul Kifti, Putri Amanda Nurhayati
Abstract: Abstract: Job training is one of the government’s efforts to improve the quality of human resources so that they possess competencies that meet labor market demands. The process of selecting training participants at the… e Department of Manpower of Asahan Regency is still carried out manually, which can lead to subjectivity and inefficiency in determining the most eligible candidates. This study aims to develop a decision support system using the Technique for Order Preference by Similarity to Ideal Solution (TOPSIS) method to assist the selection process objectively and systematically. The study applies four evaluation criteria, namely education level, age, work experience, and interview, with a dataset consisting of 31 training candidates. The system is developed as a web-based application using PHP programming language and MySQL database. The TOPSIS method is applied through decision matrix normalization, weighting, determination of positive and negative ideal solutions, and preference value calculation to produce a ranking of candidates. The results show that the proposed system can provide objective recommendations for selecting training participants, improve the efficiency of the selection process, and support decision makers in producing more accurate and reliable decisions. Keywords: decision support system; selection; training; TOPSIS.   Abstrak: Pelatihan tenaga kerja merupakan salah satu upaya pemerintah dalam meningkatkan kualitas sumber daya manusia agar memiliki kompetensi yang sesuai dengan kebutuhan dunia kerja. Proses pemilihan calon peserta pelatihan di Dinas Tenaga Kerja Kabupaten Asahan selama ini masih dilakukan secara manual sehingga berpotensi menimbulkan subjektivitas dan kurang efektif dalam menentukan peserta yang paling layak. Penelitian ini bertujuan untuk membangun sistem pendukung keputusan menggunakan metode Technique for Order Preference by Similarity to Ideal Solution (TOPSIS) untuk membantu proses seleksi peserta pelatihan secara objektif dan sistematis. Penelitian ini menggunakan empat kriteria penilaian yaitu pendidikan, usia, pengalaman kerja, dan wawancara dengan jumlah data sebanyak 31 calon peserta pelatihan. Sistem dikembangkan berbasis web menggunakan bahasa pemrograman PHP dan database MySQL. Metode TOPSIS digunakan untuk melakukan normalisasi matriks keputusan, pembobotan, penentuan solusi ideal positif dan negatif, serta perhitungan nilai preferensi untuk menghasilkan perankingan peserta pelatihan. Hasil penelitian menunjukkan bahwa sistem yang dibangun mampu memberikan rekomendasi peserta pelatihan secara objektif, meningkatkan efisiensi proses seleksi, serta membantu pihak dinas dalam pengambilan keputusan yang lebih akurat. Kata kunci: pelatihan; seleksi; sistem pendukung keputusan; TOPSIS.

FORENSIC ANALYSIS OF DIGITAL ARTIFACTS OF QR CODE PHISHING ATTACK AT 'AISYIYAH UNIVERSITY YOGYAKARTA

Djaibakal, Yunan Al-husaini, Firdonsyah, Arizona
Abstract: Abstract: The use of QR Codes in academic settings has increased with the digitization of attendance systems, but it has also introduced potential abuse in the form of quishing attacks (QR phishing). Previous studies have… e mainly focused on user behavior, while forensic analysis of digital artifacts as evidence is still limited. This study aims to conduct a forensic analysis of browser artifacts resulting from interactions with dangerous QR Codes at Aisyiyah University Yogyakarta using the framework of the National Justice Institute (NIJ). Six investigation parameters are defined: domain identification, endpoint identification, identification of supporting resources, visualization of image artifacts, timestamp correlation, and HTML reconstruction. Data is obtained from the Google Chrome profile directory and analyzed using Autopsy, focusing on Web Cache, Browser History, and Cookies artifacts. The results showed that five parameters were successfully identified with an investigation success rate of 83.3%, while HTML reconstruction could not be fully achieved due to cache limitations. These findings show that Web Cache artifacts provide evidentiary value in the forensic investigation of QR Code-based attacks. Future research should focus on improving full-page reconstruction techniques. Keywords: browser forensics; digital artifacts; NIJ; quishing; Web Cache     Abstrak: Penggunaan Kode QR di lingkungan akademik telah meningkat seiring dengan digitalisasi sistem absensi, tetapi juga menimbulkan potensi penyalahgunaan dalam bentuk serangan phishing (QR phishing). Studi sebelumnya sebagian besar berfokus pada perilaku pengguna, sementara analisis forensik artefak digital sebagai bukti masih terbatas. Studi ini bertujuan untuk melakukan analisis forensik artefak browser yang dihasilkan dari interaksi dengan Kode QR berbahaya di Universitas 'Aisyiyah Yogyakarta menggunakan kerangka kerja Lembaga Kehakiman Nasional (NIJ). Enam parameter investigasi didefinisikan: identifikasi domain, identifikasi titik akhir, identifikasi sumber daya pendukung, visualisasi artefak gambar, korelasi stempel waktu, dan rekonstruksi HTML. Data diperoleh dari direktori profil Google Chrome dan dianalisis menggunakan Autopsy, dengan fokus pada artefak Cache Web, Riwayat Browser, dan Cookie. Hasil menunjukkan bahwa lima parameter berhasil diidentifikasi dengan tingkat keberhasilan investigasi sebesar 83,3%, sementara rekonstruksi HTML tidak dapat sepenuhnya dicapai karena keterbatasan cache. Temuan ini menunjukkan bahwa artefak Cache Web memberikan nilai bukti dalam investigasi forensik serangan berbasis Kode QR. Penelitian selanjutnya harus fokus pada peningkatan teknik rekonstruksi halaman penuh.   Kata kunci: forensik peramban; artefak digital; NIJ; quishing; web cache

MULTI VIEW FEATURE FUSION FOR INDUSTRIAL ANOMALY DETECTION USING 1D-CNN

Nainggolan, Daniel Fernando, Hiskiawan, Puguh
Abstract: Abstract: Anomalous sound detection is essential for industrial predictive maintenance, as machine failures often originate from subtle acoustic changes during operation. However, high background noise and limitations of… conventional Convolutional Neural Networks (CNN) reduce detection reliability. This study proposes a 1D-CNN-based anomaly detection framework with multi-view feature fusion and temporal segmentation to enhance detection performance. The approach combines MFCC, Log-Mel Spectrogram, and Chroma STFT features, while temporal segmentation divides audio signals into 5-second segments to better capture transient anomalies. Experiments on the MIMII dataset under varying Signal-to-Noise Ratio (SNR) conditions show that MFCC and Log-Mel fusion achieves the best performance, with 97.90% accuracy and ROC-AUC of 0.9789. The model maintains accuracy above 90% at −6 dB, demonstrating strong robustness in noisy industrial environments. Keywords: industrial anomaly detection; 1D-CNN; multi-view feature fusion; temporal segmentation; MIMII dataset.   Abstrak: Deteksi anomali suara merupakan komponen penting dalam sistem pemeliharaan prediktif industri, karena kegagalan mesin sering diawali oleh perubahan akustik yang bersifat halus selama proses operasi. Namun, tingkat kebisingan yang tinggi serta keterbatasan arsitektur Convolutional Neural Network (CNN) konvensional dapat menurunkan keandalan deteksi. Penelitian ini bertujuan mengusulkan kerangka deteksi anomali berbasis 1D-CNN yang mengintegrasikan strategi fusi fitur multi-view dan segmentasi temporal untuk meningkatkan kinerja deteksi. Pendekatan yang digunakan menggabungkan fitur MFCC, Log-Mel Spectrogram dan Chroma STFT, sementara teknik temporal splitting membagi sinyal audio menjadi segmen berdurasi 5 detik untuk menangkap anomali yang bersifat sementara. Eksperimen menggunakan dataset MIMII pada berbagai kondisi Signal-to-Noise Ratio (SNR) menunjukkan bahwa kombinasi MFCC dan Log-Mel Spectrogram menghasilkan kinerja terbaik dengan akurasi 97,90% dan ROC-AUC sebesar 0,9789. Model juga mempertahankan akurasi di atas 90% pada kondisi kebisingan ekstrem (−6 dB) yang menunjukkan ketahanan yang baik dalam lingkungan industri yang bising. Kata kunci: deteksi anomali industri; 1D-CNN; fusi fitur multi-view; segmentasi temporal; dataset MIMII

IOT BASED HYDROPONIC WATER QUALITY CONTROL INTEGRATED WITH WEBSITE AND EARLY WARNING

Herman Saputra, Nofriadi, Nofriadi
Abstract: Abstract: The development of information and communication technology has driven digital transformation in various sectors, including agriculture. One of the technologies widely applied is the Internet of Things (IoT), which… hich enables devices to be interconnected through the internet to perform monitoring and data exchange in real time. In hydroponic cultivation, water quality stability is a crucial factor that affects plant growth. The main parameters that need to be monitored include water acidity level (pH), water temperature, and dissolved nutrient concentration measured using Total Dissolved Solids (TDS). However, water quality monitoring is still commonly conducted manually, making it less efficient and potentially causing delays in detecting changes in water conditions. This study aims to design an IoT-based water quality monitoring system for hydroponic cultivation using an ESP32 microcontroller integrated with pH, temperature, and TDS sensors. The collected data are sent to a server and displayed on a web dashboard in real time, equipped with automatic notification features. The proposed system is expected to improve monitoring efficiency and increase the productivity of hydroponic cultivation       Keywords: esp32; hydroponics; internet of things; real-time monitoring; water quality.   Abstrak: Perkembangan teknologi informasi dan komunikasi mendorong transformasi digital dalam berbagai sektor, termasuk pertanian. Salah satu teknologi yang banyak diterapkan adalah Internet of Things (IoT) yang memungkinkan perangkat saling terhubung melalui jaringan internet untuk melakukan pemantauan dan pertukaran data secara real-time. Pada budidaya hidroponik, kestabilan kualitas air menjadi faktor penting yang mempengaruhi pertumbuhan tanaman. Parameter utama yang perlu diperhatikan meliputi tingkat keasaman air (pH), suhu air, serta konsentrasi nutrisi terlarut yang diukur menggunakan Total Dissolved Solids (TDS). Namun, pemantauan kualitas air masih banyak dilakukan secara manual sehingga kurang efisien dan berpotensi menimbulkan keterlambatan dalam mendeteksi perubahan kondisi air. Penelitian ini bertujuan merancang sistem pemantauan kualitas air hidroponik berbasis IoT menggunakan mikrokontroler ESP32 yang terintegrasi dengan sensor pH, suhu, dan TDS. Data dikirim ke server dan ditampilkan pada web dashboard secara real-time serta dilengkapi notifikasi otomatis. Sistem ini diharapkan meningkatkan efisiensi pemantauan dan produktivitas budidaya hidroponik. Kata kunci: esp32; hidroponik; internet of things; kualitas air; monitoring real-time

SENTIMENT ANALYSIS USING MACHINE LEARNING FOR DIGITAL SERVICE DEVELOPMENT

Balqis, Rugaiyah, Jahda Rusti Putri, Mira Afrina, Ibrahim, Ali, Fathoni, Fathoni
Abstract: Abstract: The rapid growth of e-commerce mobile applications has generated large volumes of user reviews, making manual sentiment analysis increasingly impractical. This study aims to compare the effectiveness of three machine… achine learning algorithms Support Vector Machine (SVM), Random Forest, and Naive Bayes for automated sentiment classification of Indonesian-language mobile application reviews. A dataset of 3,000 user reviews from the RupaRupa application on the Google Play Store was collected and preprocessed through normalization, tokenization, stopword removal, and stemming. TF-IDF vectorization was applied for feature extraction, while the Synthetic Minority Over-sampling Technique (SMOTE) was used to address class imbalance across three sentiment categories: positive, negative, and neutral. The results show that SVM achieved the highest accuracy of 90.02%, while Random Forest obtained the best F1-score of 88.08% when sufficient training data were available. Naive Bayes demonstrated relatively stable performance across varying training data sizes. Furthermore, TF-IDF keyword analysis revealed that negative reviews were primarily associated with delivery issues, technical problems, and pricing concerns. These findings demonstrate the effectiveness of machine learning approaches for sentiment classification and provide practical insights for improving mobile application services.   Keywords: sentiment analysis; machine learning; SMOTE; TF-IDF; text classification   Abstrak: Pertumbuhan pesat aplikasi mobile e-commerce telah menghasilkan volume ulasan pengguna yang sangat besar, sehingga analisis sentimen secara manual menjadi semakin tidak praktis. Penelitian ini bertujuan untuk membandingkan efektivitas tiga algoritma machine learning Support Vector Machine (SVM), Random Forest, dan Naive Bayes dalam melakukan klasifikasi sentimen otomatis terhadap ulasan aplikasi mobile berbahasa Indonesia. Dataset yang digunakan terdiri dari 3.000 ulasan pengguna aplikasi RupaRupa yang dikumpulkan dari Google Play Store. Data kemudian diproses melalui tahapan preprocessing yang meliputi normalisasi, tokenisasi, penghapusan stopword, dan stemming. Ekstraksi fitur dilakukan menggunakan metode Term Frequency–Inverse Document Frequency (TF-IDF), sedangkan ketidakseimbangan kelas ditangani menggunakan Synthetic Minority Over-sampling Technique (SMOTE) pada tiga kategori sentimen, yaitu positif, negatif, dan netral. Hasil penelitian menunjukkan bahwa SVM mencapai tingkat akurasi tertinggi sebesar 90,02%, sementara Random Forest memperoleh nilai F1-score terbaik sebesar 88,08% ketika tersedia data pelatihan yang memadai. Naive Bayes menunjukkan performa yang relatif stabil pada berbagai ukuran data pelatihan. Selain itu, analisis kata kunci berbasis TF-IDF mengungkapkan bahwa ulasan negatif terutama berkaitan dengan masalah pengiriman, kendala teknis aplikasi, dan isu harga. Temuan ini menunjukkan bahwa pendekatan machine learning efektif untuk klasifikasi sentimen serta memberikan wawasan yang bermanfaat dalam meningkatkan kualitas layanan aplikasi mobile.   Kata Kunci: analisis sentimen; pembelajaran mesin; SMOTE; TF-IDF; klasifikasi teks.  

STUDENT DEPRESSION SCREENING BASED ON THE OPTIMUM DATA BALANCING AND RANDOM FOREST

Adnan, M. Sayyidul, Budi Santoso, Irwan, Crysdian , Cahyo
Abstract: Abstract: Mental health issues, particularly depression among young adult university students, are often detected late due to stigma and reluctance to seek medical consultation. The objective of this study is to develop… an early screening model employing machine learning techniques, specifically the random forest algorithm, on a dataset of 268 students (aged 17-29 years; consisting of 98 males and 170 females) within a multicultural educational setting. The principal challenges associated with this dataset are class imbalance and the potential for data leakage from clinical scores. This study implements a rigorous feature selection approach that involves the elimination of depression score features and the utilization of the Synthetic Minority Over-sampling Technique (SMOTE) to balance the training data distribution. Furthermore, a Threshold Tuning strategy is employed to prioritize detection sensitivity (Recall). The findings indicate that reducing the decision threshold to an optimal value of 0.25 led to a substantial enhancement in the recall value, increasing it from 36% (baseline) to 77%. A feature importance analysis was conducted, the results of which indicated that Total Social Connectedness (ToSC) is the most dominant predictor. In summary, the present study corroborates the notion that optimizing sensitivity through threshold tuning is of paramount importance for medical screening. Furthermore, social isolation factors emerge as more significant indicators of depression risk than demographic attributes.             Keywords: data mining; depression; imbalanced data; random forest; smote; threshold tuning     Abstrak: Masalah kesehatan mental, khususnya depresi di kalangan mahasiswa dewasa muda, sering terdeteksi terlambat akibat stigma dan enggan mencari konsultasi medis. Tujuan studi ini adalah mengembangkan model skrining dini menggunakan teknik machine learning, khususnya algoritma random forest, pada dataset 268 mahasiswa (usia 17-29 tahun; terdiri dari 98 laki-laki dan 170 perempuan) dalam lingkungan pendidikan multikultural. Tantangan utama yang terkait dengan dataset ini adalah ketidakseimbangan kelas dan potensi kebocoran data dari skor klinis. Studi ini menerapkan pendekatan seleksi fitur yang ketat, yang melibatkan eliminasi fitur skor depresi dan penggunaan Teknik Over-sampling Minoritas Sintetis (SMOTE) untuk menyeimbangkan distribusi data pelatihan. Selain itu, strategi Penyesuaian Ambang Batas diterapkan untuk memprioritaskan sensitivitas deteksi (Recall). Hasil penelitian menunjukkan bahwa mengurangi ambang batas keputusan ke nilai optimal 0,25 menyebabkan peningkatan signifikan dalam nilai recall, dari 36% (dasar) menjadi 77%. Analisis pentingnya fitur dilakukan, hasilnya menunjukkan bahwa Total Social Connectedness (ToSC) adalah prediktor yang paling dominan. Secara ringkas, studi ini membenarkan bahwa mengoptimalkan sensitivitas melalui penyesuaian ambang batas sangat penting untuk skrining medis. Selain itu, faktor isolasi sosial muncul sebagai indikator risiko depresi yang lebih signifikan daripada atribut demografis.   Kata kunci: penambangan data; depresi; data tidak seimbang; hutan acak; smote; penyesuaian ambang batas