Search Articles & Publications

Showing 161 articles found for "Concern"

SENTIMENT ANALYSIS USING MACHINE LEARNING FOR DIGITAL SERVICE DEVELOPMENT

Balqis, Rugaiyah, Jahda Rusti Putri, Mira Afrina, Ibrahim, Ali, Fathoni, Fathoni
Abstract: Abstract: The rapid growth of e-commerce mobile applications has generated large volumes of user reviews, making manual sentiment analysis increasingly impractical. This study aims to compare the effectiveness of three machine… achine learning algorithms Support Vector Machine (SVM), Random Forest, and Naive Bayes for automated sentiment classification of Indonesian-language mobile application reviews. A dataset of 3,000 user reviews from the RupaRupa application on the Google Play Store was collected and preprocessed through normalization, tokenization, stopword removal, and stemming. TF-IDF vectorization was applied for feature extraction, while the Synthetic Minority Over-sampling Technique (SMOTE) was used to address class imbalance across three sentiment categories: positive, negative, and neutral. The results show that SVM achieved the highest accuracy of 90.02%, while Random Forest obtained the best F1-score of 88.08% when sufficient training data were available. Naive Bayes demonstrated relatively stable performance across varying training data sizes. Furthermore, TF-IDF keyword analysis revealed that negative reviews were primarily associated with delivery issues, technical problems, and pricing concerns. These findings demonstrate the effectiveness of machine learning approaches for sentiment classification and provide practical insights for improving mobile application services.   Keywords: sentiment analysis; machine learning; SMOTE; TF-IDF; text classification   Abstrak: Pertumbuhan pesat aplikasi mobile e-commerce telah menghasilkan volume ulasan pengguna yang sangat besar, sehingga analisis sentimen secara manual menjadi semakin tidak praktis. Penelitian ini bertujuan untuk membandingkan efektivitas tiga algoritma machine learning Support Vector Machine (SVM), Random Forest, dan Naive Bayes dalam melakukan klasifikasi sentimen otomatis terhadap ulasan aplikasi mobile berbahasa Indonesia. Dataset yang digunakan terdiri dari 3.000 ulasan pengguna aplikasi RupaRupa yang dikumpulkan dari Google Play Store. Data kemudian diproses melalui tahapan preprocessing yang meliputi normalisasi, tokenisasi, penghapusan stopword, dan stemming. Ekstraksi fitur dilakukan menggunakan metode Term Frequency–Inverse Document Frequency (TF-IDF), sedangkan ketidakseimbangan kelas ditangani menggunakan Synthetic Minority Over-sampling Technique (SMOTE) pada tiga kategori sentimen, yaitu positif, negatif, dan netral. Hasil penelitian menunjukkan bahwa SVM mencapai tingkat akurasi tertinggi sebesar 90,02%, sementara Random Forest memperoleh nilai F1-score terbaik sebesar 88,08% ketika tersedia data pelatihan yang memadai. Naive Bayes menunjukkan performa yang relatif stabil pada berbagai ukuran data pelatihan. Selain itu, analisis kata kunci berbasis TF-IDF mengungkapkan bahwa ulasan negatif terutama berkaitan dengan masalah pengiriman, kendala teknis aplikasi, dan isu harga. Temuan ini menunjukkan bahwa pendekatan machine learning efektif untuk klasifikasi sentimen serta memberikan wawasan yang bermanfaat dalam meningkatkan kualitas layanan aplikasi mobile.   Kata Kunci: analisis sentimen; pembelajaran mesin; SMOTE; TF-IDF; klasifikasi teks.  

COMPARISON OF CLUSTERING MODELS FOR GROUPING LIFESTYLE PATTERNS AND OBESITY FACTORS

Al Mas Ud, Khalid, Fathoni, Fathoni, Muhammad Kurniawan, Hafiz
Abstract: Abstract: Obesity is an escalating global health concern, with unhealthy lifestyle patterns contributing significantly to its development. This study aims to evaluate and compare three clustering techniques for categorizing… ing lifestyle patterns and obesity-related factors: K-Means, Agglomerative Clustering, and Gaussian Mixture Model (GMM). The data used in this study is sourced from the Food Nutrition dataset, which includes variables such as dietary habits, physical activity, and socio-economic status. The three clustering methods were assessed using evaluation metrics such as Silhouette Score, Davies-Bouldin Index (DBI), and Calinski-Harabasz Index (CHI). The findings revealed that K-Means exhibited the best performance in terms of cluster separation with a Silhouette Score of 0.5559, while GMM showed better flexibility in handling more complex data. Although Agglomerative Clustering produced acceptable results, it had a higher overlap between clusters compared to the other methods. This study offers valuable insights into selecting the most appropriate clustering technique based on the data characteristics.             Keywords: agglomerative; clustering; GMM; k-means; lifestyle patterns; obesity   Abstrak: Obesitas menjadi masalah kesehatan yang semakin meningkat di seluruh dunia, dengan pola hidup yang tidak sehat berperan besar dalam perkembangannya. Penelitian ini bertujuan untuk membandingkan tiga metode clustering dalam mengelompokkan pola gaya hidup dan faktor yang memengaruhi obesitas, yaitu K-Means, Agglomerative Clustering, dan Gaussian Mixture Model (GMM). Data yang digunakan diperoleh dari dataset Food Nutrition yang mencakup informasi terkait pola makan, aktivitas fisik, serta faktor sosial-ekonomi. Ketiga metode tersebut diuji dengan menggunakan beberapa metrik evaluasi, seperti Silhouette Score, Davies-Bouldin Index (DBI), dan Calinski-Harabasz Index (CHI). Hasil penelitian menunjukkan bahwa K-Means memiliki kinerja terbaik dalam hal pemisahan klaster, dengan nilai Silhouette Score sebesar 0.5559, sementara GMM lebih fleksibel dalam menangani data yang lebih kompleks. Meskipun Agglomerative Clustering memberikan hasil yang dapat diterima, tumpang tindih antar klaster lebih besar dibandingkan dengan kedua metode lainnya. Penelitian ini memberikan pemahaman yang lebih baik mengenai pemilihan metode clustering yang tepat berdasarkan karakteristik data yang digunakan.   Kata kunci: agglomerative; clustering; GMM; k-means; obesitas; pola gaya hidup

COMPARISON OF BILSTM, SVM FOR PBB-P2 TAX POLICY SENTIMENT ANALYSIS

Rofiqoh, Dayana, Subarkah, Pungkas, Isnaini, Khairunnisak Nur
Abstract: Abstract: The policy to increase the Rural and Urban Land and Building Tax (PBB-P2) in Indonesia often elicits mixed reactions from the public. Some support it because they believe it can strengthen regional fiscal capacity,… ity, while others reject it because they are concerned that it will increase the economic burden on the community. Understanding public sentiment towards this policy is important for evaluating the effectiveness of the policy and formulating appropriate communication strategies. This study aims to analyze public sentiment towards the PBB-P2 increase policy using data uploaded on Platform X (Twitter). The data were collected through crawling with the keyword “building tax,” then processed through several preprocessing stages before classifying tweets into positive and negative sentiments. Two models were used: Support Vector Machine (SVM) and Bidirectional Long Short-Term Memory (BiLSTM). Results show that SVM outperformed BiLSTM, achieving training accuracy of 99.4% and testing accuracy of 85.9%, with accuracy 0.8595, precision 0.8536, recall 0.8595, and F1-score 0.8449. Meanwhile, BiLSTM achieved training accuracy of 86.9% and testing accuracy of 82.9%, with accuracy 0.8294, precision 0.8150, recall 0.8294, and F1-score 0.8080. These findings suggest SVM is more effective in classifying public sentiment and can support better evaluation of regional tax policies.             Keywords: sentiment analysis; PBB-P2; BiLSTM; SVM; X platform     Abstrak: Kebijakan kenaikan tarif Pajak Bumi dan Bangunan Perdesaan dan Perkotaan (PBB-P2) di In-donesia sering memunculkan beragam reaksi dari masyarakat. Sebagian mendukung karena dianggap dapat memperkuat kapasitas fiskal daerah, sementara lainnya menolak karena kha-watir menambah beban ekonomi masyarakat. Pemahaman terhadap sentimen publik atas ke-bijakan tersebut penting untuk mengevaluasi efektivitas kebijakan dan merumuskan strategi komunikasi yang tepat. Penelitian ini bertujuan menganalisis sentimen masyarakat terhadap kebijakan kenaikan PBB-P2 menggunakan data unggahan di Platform X (Twitter). Data dik-umpulkan melalui proses crawling dengan kata kunci “pajak bangunan” kemudian diproses melalui beberapa tahap preprocessing sebelum diklasifikasikan menjadi sentimen positif dan negatif. Dua model digunakan dalam penelitian ini, yaitu Support Vector Machine (SVM) dan Bidirectional Long Short-Term Memory (BiLSTM). Hasil penelitian menunjukkan bahwa SVM memiliki kinerja lebih baik dibandingkan BiLSTM, dengan akurasi pelatihan 99,4% dan akurasi pengujian 85,9%. Nilai akurasi 0,8595, precision 0,8536, recall 0,8595, dan F1-score 0,8449. Sementara itu, BiLSTM memperoleh akurasi pelatihan 86,9% dan akurasi pengujian 82,9%, dengan akurasi 0,8294, precision 0,8150; recall 0,8294; dan F1-score 0,8080. Temuan ini menunjukkan bahwa SVM lebih efektif dalam mengklasifikasikan sentimen publik serta dapat mendukung evaluasi kebijakan pajak daerah dengan lebih baik.   Kata kunci: analisis sentimen; PBB-P2; BiLSTM; SVM; platform X

CUSTOMER MAPPING SYSTEM WITH WEB TECHNOLOGY ON THE SIDEAK MOTOR TO IMPROVE EFFICIENCY AND ACCURACY

Nababan, Pesta Cici Dubliana, Saputra, Herman, Syahputra, Abdul Karim
Abstract: Abstract: The implementation of Geographic Information Systems (GIS) within organizations has become essential in accomplishing work activities in the modern era. Sideak Motor is a financing company in Kisaran City, Asahan… an Regency, that provides loans using motorcycle registration certificates (BPKB) as collateral, with a customer base reaching 6,052. Sideak Motor faces difficulties in data management. During meetings concerning customer locations, data communication with owners and office staff is often problematic. Additionally, when duties are transferred, new field officers struggle to locate customers because the previous officers could only provide textual information. As a result, office staff have no precise knowledge of customer locations—only the field officers do. This study aims to design a web-based customer mapping system to facilitate information storage, reduce costs, save time, and produce an information system that enhances the efficiency and accuracy of customer data management. The resulting system presents the distribution of customer locations and provides accessible information such as personal data, addresses, route details, and photos of customers’ homes, thereby simplifying the operations of Sideak Motor. Keywords: customer distribution mapping; geographic information system (GIS); sideak motor.   Abstrak: Penerapan sistem informasi geografis dalam organisasi menjadi hal utama untuk menyelesaikan suatu aktivitas pekerjaan pada era sekarang ini. Sideak Motor merupakan salah satu perusahaan pembiayaan dengan agunan BPKB sepeda motor di Kota Kisaran Kabupaten Asahan yang memiliki nasabah mencapai 6.052, Sideak Motor kesulitan dalam pengelolaan data, saat melakukan rapat mengenai lokasi nasabah sulit dilakukan komunikasi data dengan pemilik dan petugas kantor lainnya, serta pada saat pergantian tugas, petugas lainnya kesulitan mencari lokasi nasabah, karena petugas lapangan hanya bisa memberikan informasi berupa teks, dengan begitu petugas kantor tidak mengetahui lokasi pasti nasabah Sideak Motor, jadi yang mengetahui lokasi mengenai tempat tinggal nasabah hanya petugas lapangan. Penelitian ini memiliki tujuan untuk merancang sebuah sistem pemetaan nasabah berbasis web yang dapat mempermudah dalam penyimpanan informasi, mengurangi biaya, menghemat waktu serta menghasilkan sistem informasi yang dapat meningkatkan efisiensi dan akurasi pengelolaan data nasabah. Hasil sistem ini menyajikan sebaran pemetaan lokasi nasabah menyediakan informasi berupa biodata, alamat, rincian rute, dan gambar rumah nasabah yang dapat diakses secara cepat dan akurat sehingga dapat mempermudah pihak sideak motor. Kata Kunci: pemetaan sebaran nasabah; sistem informasi geografis (SIG); sideak motor

THE USE OF IOT IN WATER UTILIZATION STRATEGIES FOR SMART IRRIGATION SYSTEMS BASED ON MACHINE LEARNING

Junaidi, Junaidi
Abstract: Abstract: Water irrigation is a crucial aspect of agriculture that often becomes the primary concern for farmers, especially because suboptimal management can lead to decreased crop yields and reduced income. So far, farmers… mers have been practicing irrigation manually, where plants are watered twice a day, in the morning and evening, based on weather conditions without considering soil temperature or moisture levels. Based on the observations conducted, it was found that excessive water application increases water accumulation, resulting in nutrient loss from the soil and even root diseases. The objective of this study is to develop a system utilizing an ESP32 microcontroller and sensors to detect soil moisture, with a machine learning-based K-Nearest Neighbor (KNN) model, enabling farmers to remotely monitor and control their crops using an Android device. The testing results showed that with input data of 32°C temperature, 40% soil moisture, and 60% air humidity, the system produced a nearest distance of 0.000 and 0.541 from the closest k-nearest neighbors, with a status label of "needs water." As a result, the relay activates the water pump to irrigate the field. Meanwhile, for data with a nearest distance of 0.897, the system identified the status as "does not need water," indicating that the soil remains wet or moist. This study is expected to help reduce farmers' workloads by optimizing water usage according to plant needs and improving crop quality and yield.         Keywords: k-nearest neighbor (KNN); mikrokontroller ESP32; machine learning; water irrigation   Abstrak: Irigasi air merupakan aspek penting dalam pertanian yang menjadi perhatian utama petani, terutama karena pengelolaan yang kurang optimal berdampak pada penurunan hasil panen dan pendapatan. Selama ini, praktik irigasi oleh petani dilakukan secara manual, di mana penyiraman tanaman dilakukan dua kali sehari pada pagi dan sore berdasarkan kondisi cuaca tanpa memperhatikan suhu atau kelembaban tanah. Berdasarkan hasil observasi yang dilakukan, ditemukan masalah yaitu pemberian air secara berlebih menyebabkan akumulasi air meningkat mengakibatkan kehilangan nutrisi tanah dan bahkan penyakit akar. Tujuan penelitian ini menciptakan sistem yang dirancang menggunakan mikrokontroler ESP32 dan sensor untuk mendeteksi kelembaban tanah, dengan model K-Nearest Neighbor (KNN) berbasis machine learning sehingga memudahkan petani untuk mengontrol tanaman mereka dari jarak jauh menggunakan android. Hasil pengujian yang dilakukan dengan data inputan berupa suhu 32°C, kelembaban tanah 40% dan kelembaban udara 60%, sistem menghasilkan jarak terdekat sebesar 0.000 dan 0.541 dari k-nearest terdekat dengan label status "butuh air". Maka relay akan mengaktifkan pompa air untuk mengairi lahan. Kemudian, pada data dengan jarak terdekat 0.897, sistem mengidentifikasi status "tidak butuh air", menunjukkan bahwa kondisi tanah masih basah atau lembab. Penelitian ini diharapkan dapat membantu meringankan beban kerja petani mengoptimalkan penggunaan air sesuai dengan kebutuhan tanaman dan meningkatkan kualitas hasil panen. Kata kunci: irigasi air; k-nearest neighbor (KNN); mikrokontroller ESP32; machine learning

OPTIMIZATION OF CART ALGORITHM BASED ON ANT BE COLONY FEATURE SELECTION FOR STUNTING DIAGNOSIS

Subarkah, Pungkas, Ikhsan, Ali Nur, Wahyudi, Rizki, Rofiqoh, Dayana
Abstract: Abstract: One of the main health problems in children is stunting which is one of the concerns in the Sustainable Development Goals (SDGs). Specifically in Indonesia, the prevalence of stunting in 2024 is 21.6%. This figure… ure is still relatively high, because the target prevalence of stunting is 14%. This study aims to implement machine learning knowledge through the Classification And Regression Trees (CART) algorithm based on Ant Be Colony (ABC) feature selection which aims to determine the increase in accuracy in analyzing stunting datasets. The data used comes from Kaggle which consists of 16500 datasets. The dataset consists of gender, age, birth length, birth weight, body length, body weight, breastfeeding and stunting status. The research methods used are data collection, data preprocessing, classification, and evaluation using K-fold cross validation. The results obtained in this research are the implementation of the CART algorithm obtained a value of 89.86% and the results of CART with Ant Be Colony (ABC) feature selection, which obtained an accuracy value of 93.65%. This shows that there is an increase in the accuracy value in the use of CART algorithm optimization and Ant Be Colony (ABC) feature selection by 3.76%. With the research results that have been obtained, it can be categorized as excellent accuracy value excellent. It is hoped that further research can be carried out by adding other classification algorithms or adding feature selection.             Keywords: classification; feature selection; optimazation; stunting   Abstrak: Salah satu masalah kesehatan utama pada anak adalah stunting yang menjadi salah satu perhatian dalam Sustainable Development Goals (SDGs). Khusus di Indonesia angka Pravelensi stunting pada tahun 2024 di angka 21.6%. Angka ini masih tergolong tinggi, karena target angka pravelensi stunting ialah 14%. Penelitian ini bertujuan untuk mengimplementasikan pengetahuan machine learning melalui algoritma Classification And Regression Trees (CART) berbasis seleksi fitur Ant Be Colony (ABC) yang bertujuan untuk mengetahui peningkatan akurasi dalam menganalisis dataset stunting. Data yang digunakan bersumber dari Kaggle yang terdiri dari 16500 dataset. Dataset terdiri dari jenis kelamin, usia, panjang lahir, berat lahir, panjangg badan, berat badan, menyusui dan status stunting.  Metode penelitian yang digunakan adalah pengumpulan data, preprocessing data, klasifikasi, dan evaluasi menggunakan K-fold cross validation. Hasil yang diperoleh pada penelitian ini adalah Implementasi algoritma CART memperoleh nilai sebesar 89,86% dan hasil seleksi fitur CART dengan Ant Be Colony (ABC) memperoleh nilai akurasi sebesar 93,65%. Hal ini menunjukkan adanya peningkatan nilai akurasi pada penggunaan optimasi algoritma CART dan pemilihan fitur Ant Be Colony (ABC) sebesar 3,76%. Dengan hasil penelitian yang telah diperoleh dapat dikategorikan nilai akurasi yang diperoleh sangat baik. Diharapkan dapat dilakukan penelitian selanjutnya dengan menambahkan algoritma klasifikasi lain atau menambahkan seleksi fitur.   Kata kunci: klasifikasi; optimalisasi; seleksi fitur; stunting

DESIGNING TAX ME SERVICE APPLICATIONS IN TAX CONSULTING

Joosten, Joosten, Halim, Fandi, Arianto, Jennifer, Yulinda, Cindy
Abstract: Abstract: "Tax Me" is an application engaged in tax consulting services that is run through a mobile platform. The problems that are often faced by the public, especially taxpayers, are difficulties in choosing reliable… and trusted tax consultants because many tax consultants embezzle money and slow down the tax reporting process, as well as the lack of knowledge of taxpayers about all tax regulations, a complicated and frequently changing tax system, and also there are still negative public assumptions about taxes such as corruption in taxes that have been paid by taxpayers.  The "Tax Me" application was developed using the System Development Life Cycle (SDLC) system development methodology. This application was developed as a forum for tax consulting services in collaboration with the Directorate General of Taxes (DGT) institution which is able to provide transparent and reliable tax consulting services. "Tax Me" is expected to be able to provide education to taxpayers, overcome taxpayers' concerns about the tax calculation and reporting process as well as in choosing a tax consultant who can be trusted. In addition, several features of the "Tax Me" application such as: NPWP, Tax Calculation, Tax Consultation, Report & Check Annual Tax Return, E-Billing & Pay Tax, Tax Reminder and Tax Article.             Keywords: directorate general of taxes (DJP); tax; tax me; taxpayer     Abstrak: “Tax Me” adalah aplikasi yang bergerak pada bidang pelayanan konsultasi pajak yang dijalankan melalui platform mobile. Masalah yang sering dihadapi oleh masyarakat khususnya Wajib Pajak adalah kesulitan dalam memilih konsultan pajak yang dapat diandalkan dan dipercaya karena banyak konsultan pajak yang menggelapkan uang dan memperlambat proses pelaporan pajak, serta kurangnya pengetahuan Wajib Pajak mengenai segala peraturan perpajakan, sistem perpajakan yang rumit dan sering berubah, dan juga masih ada anggapan negatif masyarakat tentang pajak seperti korupsi atas pajak yang telah dibayarkan oleh Wajib Pajak. Aplikasi “Tax Me” dikembangkan dengan menggunakan metodologi pengembangan sistem System Development Life Cycle (SDLC). Aplikasi ini dikembangkan sebagai wadah layanan konsultasi perpajakan yang bekerja sama dengan lembaga Direktorat Jenderal Pajak (DJP) yang mampu memberikan layanan konsultasi perpajakan yang transparan dan terpercaya. “Tax Me” diharapkan mampu memberikan edukasi kepada Wajib Pajak, mengatasi kekhawatiran Wajib Pajak terhadap proses perhitungan dan pelaporan pajak juga dalam memilih konsultan pajak yang dapat di percaya. Disamping itu, beberapa fitur dari aplikasi “Tax Me” seperti: NPWP, Hitung Pajak, Konsultasi Pajak, Lapor & Periksa SPT Tahunan, E-Billing & Bayar Pajak, Pengingat Pajak dan Artikel Pajak.   Kata kunci: direktorat jenderal pajak (DJP); pajak; tax me; wajib pajak  

ASSESSING EFFECTIVENESS JEMBER REGENCY EDUCATION DEPARTMENT WEBSITE USING COBIT FRAMEWORK

Sari, Ciptianingsih Ghonita, Wardoyo, Ari Eko, A’yun, Qurrota
Abstract: Abstract: In the digital era of transformation, educational websites serve as vital platforms for transparently disseminating information to stakeholders. This study evaluates the effectiveness of the Jember Regency Education… ation Department website using the COBIT 5 framework. This study aims to enhance the effectiveness and usability of the Department of Education website in Jember Regency by aligning it with stakeholders' evolving needs through comprehensive evaluation and targeted recommendations. Employing a qualitative descriptive approach, the research identifies challenges such as mobile optimization issues, slow loading times, security vulnerabilities, and content relevance concerns. Despite commendable accessibility, these challenges significantly impact user experience and website credibility. The findings underscore the urgent need for website optimization, improved security measures, and continuous content updates. This research provides actionable recommendations to align the website with IT governance standards, offering a roadmap for enhancement. Furthermore, the MEA Capability Results highlight discrepancies between the current scores and expected standards, indicating the necessity for comprehensive alignment with COBIT 5 guidelines to optimize website functionality and better meet user expectations.Top of Form             Keywords: COBIT 5 framework; Jember Regency Department of Education; website effectiveness     Abstrak: Pada era transformasi digital, situs web pendidikan menjadi platform penting untuk menyebarkan informasi secara transparan kepada para pemangku kepentingan. Studi ini mengevaluasi efektivitas situs web Dinas Pendidikan Kabupaten Jember menggunakan kerangka kerja COBIT 5. Studi ini bertujuan untuk meningkatkan efektivitas dan kegunaan situs web Dinas Pendidikan di Kabupaten Jember dengan menyelaraskannya dengan kebutuhan yang berkembang dari para pemangku kepentingan melalui evaluasi komprehensif dan rekomendasi yang ditargetkan. Dengan pendekatan deskriptif kualitatif, penelitian ini mengidentifikasi tantangan seperti masalah optimasi seluler, waktu muat yang lambat, kerentanan keamanan, dan kekhawatiran tentang relevansi konten. Meskipun aksesibilitasnya baik, tantangan-tantangan ini secara signifikan memengaruhi pengalaman pengguna dan kredibilitas situs web. Temuan ini menegaskan perlunya pengoptimalan situs web, peningkatan langkah-langkah keamanan, dan pembaruan konten yang berkelanjutan. Penelitian ini memberikan rekomendasi yang dapat dilaksanakan untuk menyelaraskan situs web dengan standar tata kelola TI, menawarkan panduan untuk peningkatan. Selain itu, hasil Kemampuan MEA menyoroti perbedaan antara skor saat ini dan standar yang diharapkan, menandakan kebutuhan akan penyesuaian yang komprehensif dengan pedoman COBIT 5 untuk mengoptimalkan fungsionalitas situs web dan memenuhi harapan pengguna dengan lebih baik. Top of Form   Kata kunci: Dinas Pendidikan Kabupaten Jember; efektivitas website; kerangka kerja COBIT 5

DETECTION OF CHILDREN'S NUTRITIONAL STATUS USING MACHINE LEARNING WITH LOGISTIC REGRESSION ALGORITHM

Yuliana, Yuliana, Paradise, Paradise, Qulub, Mudawil
Abstract: Abstract: Children's nutritional issues are an important concern for parents to pay attention to growth and development, especially health and well-being. According to the results of the Ministry of Health's Indonesian Nutrition… utrition Status Survey (SSGI), there are 4 nutritional problems for children in Indonesia, namely stunting, wasting, underweight and everweight. In this research, how to predict signs of symptoms of a decline in a child's nutritional status using a machine learning algorithm, a prediction model was designed using logistic regression in Python IDE to predict whether a child is indicated by a decline in nutrition or not. Dataset from Bengkayang Community Health Center data consisting of 657 pediatric patient data. The dataset is divided into 7 features (independent variables) and 1 predictor (dependent variable). Test results show perfect performance with precision, recall, F1-score, accuracy values of 100%. Then the visualization results on the ROC (Receiver Operating Characteristic) curve to depict the TP (True Positive) value on the Y axis against the FP (false Positive) value on the become overfit. It is recommended that in preparing the training dataset, measure the training data and reduce the features, after carrying out feature selection to increase the accuracy of the model.             Keywords: child nutritional status; growth and development logistic regression; machine learning   Abstract: Masalah Gizi anak menjadi perhatian penting bagi orangtua untuk memperhatikan tumbuh kembang, terutama kesehatan dan kejahteraan. Menurut hasil survei status Gizi Indonesia (SSGI) Kemenkes memperlihatkan 4 permasalahan gizi anak di Indonesia yaitu stunting, wasting, underweight, dan everweight. Dalam penelitian ini, bagaimana memprediksi tanda gejala penurunan status gizi anak menggunakan  algoritma  machine  learning dirancang model prediksi menggunakan logistic regression pada Python IDE dengan  memprediksi anak  terindikasi  penurunan gizi  atau tidak. Dataset dari data Puskesmas Bengkayang  yang terdiri 657 data pasien anak. Dataset dibagi menjadi 7 feature (variabel independen) dan 1 predictor (variabel dependen). Hasil Pengujian memperlihatkan kinerja yang sempurna dengan nilai presisi, recall,  F1-score, akurasi, sebesar 100%. Kemudian hasil Visualisasi pada kurva ROC (Receiver Operating Characteristic) untuk menggambarkan nilai TP (True Positif) di sumbu Y terhadap nilai FP (false Positif) di sumbu X juga menunjukkan nilai yang sangat tinggi dan sudah mendekati angka 1 ini pertanda bahwa model ini menjadi overfit. Sebaiknya dalam persiapan training dataset diukur dengan data training dan mengurangi feature, setelah melakukan feature Selection untuk meningkatkan akurasi model.   Keywords: logistic regression; machine learning; status gizi anak; tumbuh kembang

CLASSIFICATION OF FAKE NEWS IN INDONESIAN LANGUAGE USING SUPPORT VECTOR MACHINE METHOD

Tandiano, Andreas Halim, Jollyta, Deny
Abstract: Abstract: Since information and communication technology has become ingrained in our daily lives, it has become easier to access information. However, there are some concerns. One of them is about fake news. The aim of this… his study is to develop an Indonesian system for detecting false news by utilizing news headlines. The methods used are linear kernel support vector ma- chine and n-gram. According to the findings of the performance test that was carried out, the linear kernel support vector machine model employing the term frequency inverse document frequency unigram feature performs better than utilizing bigram. The precision value generated from the model performance test is 1.00. This means that the degree of accuracy in matching the requested information regarding fake news detection with the answers provided by the system is very good. Then the recall value generated is 0.99. This means the linear kernel support vector machine model using unigram news features is very effective for detecting fake news according to the text classification approach.             Keywords: classification; fake news; n-gram; support vector machine   Abstrak: Dengan adanya integrasi teknologi informasi dan komunikasi dalam kehidupan mem- buat kemudahan dalam mengakses informasi. Walaupun demikian, terdapat kekhawatiran akan beberapa hal. Salah satu di antaranya adalah berita palsu. Tujuan penelitian ini adalah merancang sistem deteksi berita palsu berbahasa Indonesia berdasarkan judul berita. Metode yang digunakan adalah Support Vector Machine kernel linier dan n-gram. Berdasarkan hasil uji performa, model Support Vector Machine kernel linier yang menggunakan fitur term frequency inverse document frequency unigram menunjukkan kinerja yang lebih baik dibandingkan bi- gram. Nilai precision yang dihasilkan dari uji performa model sebesar 1,00. Ini berarti derajat akurasi dalam mencocokkan informasi yang diminta mengenai deteksi berita palsu dengan ja- waban yang diberikan oleh sistem sangat baik. Kemudian nilai recall yang dihasilkan sebesar 0,99. Ini berarti model Support Vector Machine kernel linier dengan menggunakan fitur berita unigram sangat efektif untuk mendeteksi berita palsu menurut pendekatan teks klasifikasi.   Kata kunci: klasifikasi; berita palsu; n-gram; support vector machine