Search Articles & Publications

Showing 330 articles found for "Kate"

IMPLEMENTATION OF TRANSFORMER MODEL FOR FINE-GRAINED EMOTION DETECTION ON SOCIAL MEDIA "X"

Ulya Nisa, Nadhira, Setyaning Nastiti, Vinna Rahmayanti
Abstract: Deteksi emosi secara fine-grained pada teks media sosial merupakan salah satu tantangan dalam bidang pemrosesan bahasa alami (Natural Language Processing/NLP), terutama karena sifat data yang tidak terstruktur dan multi-label.… label. Penelitian ini bertujuan untuk mengevaluasi performa tiga model berbasis arsitektur Transformer, yaitu EmoBERT, RoBERTa, dan EmoRoBERTa, dalam tugas klasifikasi emosi pada teks dari dataset SenWave. Dataset ini terdiri dari 10.001 tweet berbahasa Inggris yang telah dilabeli ke dalam sepuluh kategori emosi, namun penelitian ini berfokus pada empat label utama: anxious, annoyed, empathetic, dan sad. Proses penelitian meliputi prapemrosesan data, tokenisasi, pembagian data latih dan uji, pelatihan model, serta evaluasi menggunakan metrik akurasi, presisi, recall, dan f1-score. Hasil evaluasi menunjukkan bahwa model EmoBERT dan EmoRoBERTa memiliki performa terbaik dengan nilai f1-score sebesar 0,81, sedangkan RoBERTa memperoleh nilai f1-score sebesar 0,73. Temuan ini menunjukkan bahwa penyesuaian arsitektur Transformer khusus untuk emosi dapat meningkatkan akurasi klasifikasi emosi pada teks media sosial.

COMPARATIVE ANALYSIS OF MACHINE LEARNING ALGORITHMS FOR COSMETIC SALES PREDICTION ON TOKOPEDIA

Sahira, Mutia, Tania, Ken Ditha, Afrina, Mira
Abstract: Abstract: The rapid growth of the cosmetics industry on e-commerce platforms has intensified competition, creating a critical need for effective, data-driven marketing strategies. This study aims to conduct a comparative… analysis of machine learning algorithms to predict the sales categories (High, Medium, Low) of cosmetic products on the Tokopedia marketplace. Four classification models; Random Forest, XGBoost, Logistic Regression, and Naive Bayes were trained and evaluated on data collected via web scraping. The methodology incorporates the Synthetic Minority Over-sampling Technique (SMOTE) to address significant class imbalance and GridSearchCV for hyperparameter optimization to ensure a fair and robust comparison. The experimental results conclusively show that the Random Forest model achieved the best performance, yielding the highest F1-Score Macro Average of 0.75 and an accuracy of 85.3%. The superior model was subsequently implemented in a simple recommendation system to simulate optimal discount strategies, demonstrating its practical utility in providing actionable insights for business decisions. Keywords: classification; comparative analysis; machine learning; sales prediction; SMOTE   Abstrak: Pertumbuhan pesat industri kosmetik pada platform e-commerce telah membuat persaingan ketat, sehingga menciptakan kebutuhan krusial akan strategi pemasaran yang efektif dan berbasis data. Penelitian ini bertujuan untuk melakukan analisis komparatif terhadap algoritma machine learning untuk memprediksi kategori penjualan (Tinggi, Sedang, Rendah) produk kosmetik di marketplace Tokopedia. Empat model klasifikasi, yaitu Random Forest, XGBoost, Regresi Logistik, dan Naive Bayes, dilatih dan dievaluasi menggunakan data yang dikumpulkan melalui web scraping. Metodologi penelitian ini menerapkan Synthetic Minority Over-sampling Technique (SMOTE) untuk mengatasi ketidakseimbangan kelas yang signifikan dan GridSearchCV untuk optimisasi hyperparameter guna memastikan perbandingan yang adil. Hasil eksperimen menunjukkan bahwa model Random Forest mencapai performa terbaik, dengan menghasilkan F1-Score Macro Average tertinggi sebesar 0,75 dan akurasi 85,3%. Model unggul ini kemudian diimplementasikan dalam sebuah sistem rekomendasi sederhana untuk menyimulasikan strategi diskon yang optimal, yang menunjukkan kegunaan praktisnya dalam memberikan wawasan yang dapat ditindaklanjuti untuk pengambilan keputusan bisnis. Kata kunci: analisis komparatif; klasifikasi; machine learning; prediksi penjualan; SMOTE

THE EFFECT OF FACIAL ACCESSORY AUGMENTATION ON THE ACCURACY OF DEEP LEARNING-BASED FACIAL RECOGNITION SYSTEMS

Hidayat, Ahmad Nur, Suciati, Nanik, Saikhu, Ahmad
Abstract: Abstract: Face recognition based on deep learning has become an important technology in many areas. However, these systems often face challenges in real-world conditions, such as when the face is partially covered by accessories… essories such as masks or glasses. This study aims to evaluate the effect of data augmentation by adding facial accessories (masks, glasses, and a combination of both) and geometric augmentation on the accuracy of face recognition systems. There are three types of datasets used in this method: the original dataset (category 1), the dataset with facial accessories augmentation (category 2), and the dataset with geometric augmentation (category 3). Data augmentation was performed on the training dataset to increase diversity, followed by the face detection process using SCRFD and feature extraction with ArcFace. The model was then trained using Multi-Layer Perceptron (MLP). Based on the results, adding face accessories (category 2) made the model a lot more accurate, hitting 99% accuracy. In category 3, adding geometric features improved accuracy to 91%. Other evaluation metrics, such as precision, recall, and F1-score, also showed improvement after augmentation. This study concludes that facial accessories augmentation is more effective in improving the accuracy and robustness of face recognition models compared to geometric augmentation. Keywords: augmentation; deep learning; face recognition; glasses.   Abstrak: Pengenalan wajah berbasis deep learning telah menjadi salah satu teknologi penting dalam berbagai aplikasi. Namun, sistem ini sering kali menghadapi tantangan dalam kondisi dunia nyata, seperti saat wajah tertutup sebagian oleh aksesori seperti masker atau kacamata. Penelitian ini bertujuan untuk mengevaluasi pengaruh augmentasi data dengan menambahkan aksesori wajah (masker, kacamata, dan kombinasi keduanya) serta augmentasi geometris terhadap akurasi sistem pengenalan wajah. Metode yang digunakan melibatkan tiga kategori dataset: dataset asli tanpa augmentasi (kategori 1), dataset dengan augmentasi aksesoris wajah (kategori 2), dan dataset dengan augmentasi geometris (kategori 3). Augmentasi data dilakukan pada dataset pelatihan untuk meningkatkan keberagaman, diikuti dengan proses deteksi wajah menggunakan SCRFD dan ekstraksi fitur dengan ArcFace. Model kemudian dilatih menggunakan Multi-Layer Perceptron (MLP). Hasil penelitian menunjukkan bahwa augmentasi aksesoris wajah (kategori 2) memberikan peningkatan signifikan pada akurasi model, mencapai 99%, sedangkan kategori 3 dengan augmentasi geometris mencapai akurasi 91%. Metrik evaluasi lainnya, seperti precision, recall, dan F1-score, juga menunjukkan peningkatan setelah augmentasi. Penelitian ini menyimpulkan bahwa augmentasi aksesoris wajah lebih efektif dalam meningkatkan akurasi dan ketahanan model pengenalan wajah dibandingkan dengan augmentasi geometris. Kata kunci: augmentasi; deep learning; kacamata; pengenalan wajah.

SENTIMENT ANALYSIS USING NAIVE BAYES ALGORITHM CASE STUDY ON AMAZON E-COMMERCE PRODUCT REVIEWS

Rahman, Erik, Namora, Namora, Anas, Lukman
Abstract: Analisis sentimen adalah proses mengidentifikasi dan mengklasifikasikan opini dalam teks menjadi kategori tertentu seperti positif, negatif, atau netral. Penelitian ini bertujuan untuk menganalisis sentimen ulasan produk… pada platform e-commerce menggunakan algoritma Naive Bayes. Dataset ulasan produk diambil dari Kaggle, terdiri dari ribuan ulasan dengan label sentimen. Metodologi mencakup tahap preprocessing teks, ekstraksi fitur menggunakan teknik TF-IDF, dan penerapan algoritma Naive Bayes untuk klasifikasi sentimen. Hasil penelitian menunjukkan bahwa algoritma Naive Bayes memberikan akurasi sebesar 94%, membuktikan kemampuannya dalam analisis sentimen dengan dataset teks pendek

APPLICATION OF THE K-MEANS METHOD FOR GROUPING COMMUNITY WELFARE LEVELS IN CENTRAL JAVA PROVINCE

Hidayat, Taufik, Handayani, Yuni, Novitaningrum, Dian
Abstract: Abstract: Welfare is one of the things that determines the progress of a region, to achieve the welfare of its people, especially in the economic sector, a technique is needed to measure welfare that continues to change.… This study aims to analyze the differences in the level of community welfare in Central Java Province by grouping regions based on several indicators. Grouping is done using data from various sources that include the main indicators of welfare. The method used in this study uses the K-Means data mining algorithm to group regional data according to their level of welfare. The results of the analysis divide the regions into three categories: Medium Welfare Level, which includes Banyumas, Purworejo, Boyolali, Klaten, Sukoharjo, Karanganyar, Sragen, Kudus, Jepara, Demak, Semarang, Kendal, and Pekalongan City and Tegal City, High Welfare Level, consisting of Magelang City, Surakarta City, Salatiga City, and Semarang City; and Low Welfare Level, covering Cilacap, Purbalingga, Banjarnegara, Kebumen, Wonosobo, Magelang, Wonogiri, Grobogan, Blora, Rembang, Pati, Temanggung, Batang, Pekalongan, Pemalang, Tegal, and Brebes Regencies. The findings show that the C2 region has a longer average length of schooling, higher per capita expenditure, and better HDI, reflecting a higher quality of life. This study provides an overview of welfare inequality in Central Java Province and suggests the need for more focused policies to improve the quality of life in each category of region.         Keywords: clustering; k-means; welfare   Abstrak: Kesejahreraan merupakan salah satu hal yang menentukan kemajuan suatu wilayah, untuk mencapai kesejahteraan masyarakatnya terutama di bidang ekonomi di perlukan teknik untuk mengukur kesejahteraan yang terus berubah, Penelitian ini bertujuan untuk menganalisis perbedaan tingkat kesejahteraan masyarakat di Provinsi Jawa Tengah dengan mengelompokkan wilayah berdasarkan beberapa indikator. Pengelompokan dilakukan menggunakan data dari berbagai sumber yang mencakup indikator-indikator utama kesejahteraan. Metode yang di gunakan dalam penelitian ini menggunakan algoritma data mining K-Means untuk mengelompokkan data wilayah menurut tingkat kesejahteraannya. Hasil analisis membagi wilayah menjadi tiga kategori: Tingkat Kesejahteraan Sedang, yang mencakup Kabupaten Banyumas, Purworejo, Boyolali, Klaten, Sukoharjo, Karanganyar, Sragen, Kudus, Jepara, Demak, Semarang, Kendal, serta Kota Pekalongan dan Kota Tegal, Tingkat Kesejahteraan Tinggi, terdiri dari Kota Magelang, Kota Surakarta, Kota Salatiga, dan Kota Semarang; dan Tingkat Kesejahteraan Rendah, mencakup Kabupaten Cilacap, Purbalingga, Banjarnegara, Kebumen, Wonosobo, Magelang, Wonogiri, Grobogan, Blora, Rembang, Pati, Temanggung, Temuan menunjukkan bahwa wilayah C2 memiliki rata-rata lama sekolah yang lebih panjang, pengeluaran per kapita yang lebih tinggi, dan IPM yang lebih baik, mencerminkan kualitas hidup yang lebih tinggi. Penelitian ini memberikan gambaran tentang ketidakmerataan kesejahteraan di Provinsi Jawa Tengah dan menyarankan perlunya kebijakan yang lebih terfokus untuk meningkatkan kualitas hidup di setiap kategori wilayah.   Kata Kunci: clustering; k-means;  kesejahteraan

OPTIMIZATION OF CART ALGORITHM BASED ON ANT BE COLONY FEATURE SELECTION FOR STUNTING DIAGNOSIS

Subarkah, Pungkas, Ikhsan, Ali Nur, Wahyudi, Rizki, Rofiqoh, Dayana
Abstract: Abstract: One of the main health problems in children is stunting which is one of the concerns in the Sustainable Development Goals (SDGs). Specifically in Indonesia, the prevalence of stunting in 2024 is 21.6%. This figure… ure is still relatively high, because the target prevalence of stunting is 14%. This study aims to implement machine learning knowledge through the Classification And Regression Trees (CART) algorithm based on Ant Be Colony (ABC) feature selection which aims to determine the increase in accuracy in analyzing stunting datasets. The data used comes from Kaggle which consists of 16500 datasets. The dataset consists of gender, age, birth length, birth weight, body length, body weight, breastfeeding and stunting status. The research methods used are data collection, data preprocessing, classification, and evaluation using K-fold cross validation. The results obtained in this research are the implementation of the CART algorithm obtained a value of 89.86% and the results of CART with Ant Be Colony (ABC) feature selection, which obtained an accuracy value of 93.65%. This shows that there is an increase in the accuracy value in the use of CART algorithm optimization and Ant Be Colony (ABC) feature selection by 3.76%. With the research results that have been obtained, it can be categorized as excellent accuracy value excellent. It is hoped that further research can be carried out by adding other classification algorithms or adding feature selection.             Keywords: classification; feature selection; optimazation; stunting   Abstrak: Salah satu masalah kesehatan utama pada anak adalah stunting yang menjadi salah satu perhatian dalam Sustainable Development Goals (SDGs). Khusus di Indonesia angka Pravelensi stunting pada tahun 2024 di angka 21.6%. Angka ini masih tergolong tinggi, karena target angka pravelensi stunting ialah 14%. Penelitian ini bertujuan untuk mengimplementasikan pengetahuan machine learning melalui algoritma Classification And Regression Trees (CART) berbasis seleksi fitur Ant Be Colony (ABC) yang bertujuan untuk mengetahui peningkatan akurasi dalam menganalisis dataset stunting. Data yang digunakan bersumber dari Kaggle yang terdiri dari 16500 dataset. Dataset terdiri dari jenis kelamin, usia, panjang lahir, berat lahir, panjangg badan, berat badan, menyusui dan status stunting.  Metode penelitian yang digunakan adalah pengumpulan data, preprocessing data, klasifikasi, dan evaluasi menggunakan K-fold cross validation. Hasil yang diperoleh pada penelitian ini adalah Implementasi algoritma CART memperoleh nilai sebesar 89,86% dan hasil seleksi fitur CART dengan Ant Be Colony (ABC) memperoleh nilai akurasi sebesar 93,65%. Hal ini menunjukkan adanya peningkatan nilai akurasi pada penggunaan optimasi algoritma CART dan pemilihan fitur Ant Be Colony (ABC) sebesar 3,76%. Dengan hasil penelitian yang telah diperoleh dapat dikategorikan nilai akurasi yang diperoleh sangat baik. Diharapkan dapat dilakukan penelitian selanjutnya dengan menambahkan algoritma klasifikasi lain atau menambahkan seleksi fitur.   Kata kunci: klasifikasi; optimalisasi; seleksi fitur; stunting

APPLICATION OF PARTICLE SWARM OPTIMIZATION SUPPORT VECTOR MACHINE FOR ELECTRICAL INSTALLATION CERTIFICATION PREDICTION

Priyono, Priyono, Panca Saputra, Elin, Suswandi, Suswandi, Rahman, Taufik
Abstract: Abstract: Feature selection is a crucial process that is very important to improve the performance of machine learning models, in accordance with data preprocessing. The feature selection process can be considered as a global… lobal combinatorial optimization problem in machine learning, which reduces the number of features, eliminates irrelevant data, and produces acceptable classification accuracy. The purpose of this study is to predict or determine the results of the electrical installation operation feasibility test based on data and obtain attribute selection features, and obtain accuracy level results. The Particle Swarm Optimization (PSO) approach is used to select the right characteristics to determine the results of the electrical installation operation feasibility test because attribute selection is needed in data analysis, because the PSO method will increase accuracy than just SVM in determining attribute selection. If SVM is used with PSO, the accuracy value is 96% and AUC is 0.994%, while the SVM method produces an accuracy level of 94.89% and AUC of 0.994%. With this finding, the accuracy value increases by 2%, making it a very good categorization category. It has been proven that the use of Particle Swarm Optimization (PSO) based algorithms can improve and improve results.             Keywords: PSO; SVM; Certification   Abstrak: Pemilihan fitur merupakan proses krusial yang sangat penting untuk meningkatkan kinerja model machine learning, sesuai dengan praproses data. Proses pemilihan fitur dapat dianggap sebagai masalah optimasi kombinatorial global dalam pembelajaran mesin, yang mengurangi jumlah fitur, menghilangkan data yang tidak relevan, dan menghasilkan akurasi klasifikasi yang dapat diterima. Tujuan dari penelitian ini adalah untuk memprediksi atau menentukan hasil uji kelayakan operasi instalasi listrik berdasarkan data dan memperoleh fitur pemilihan atribut, serta memperoleh hasil tingkat akurasi. Pendekatan Particle Swarm Optimization (PSO) digunakan untuk memilih karakteristik yang tepat untuk menentukan hasil uji kelayakan operasi instalasi listrik karena pemilihan atribut diperlukan dalam analisis data, karena metode PSO akan meningkatkan akurasi dari pada hanya SVM dalam menentukan pemilihan atribut. Jika SVM digunakan dengan PSO, nilai akurasinya adalah 96% dan AUC sebesar 0,994%, sedangkan metode SVM menghasilkan tingkat akurasi sebesar 94,89% dan AUC sebesar 0,994%. Dengan temuan ini, nilai akurasi meningkat sebesar 2%, menjadikannya kategori kategorisasi yang sangat baik. Telah terbukti bahwa penggunaan algoritma berbasis Particle Swarm Optimization (PSO) dapat meningkatkan dan memperbaiki hasil.   Kata kunci: PSO; SVM; Sertifikasi  

CLOTHING SALES STRATEGY AT ANEKATEX SHOP WITH E-CRM CONCEPT

Pratiwi, Winda, Amin, Muhammad, Putri, Pristiyanilicia
Abstract: Toko Anekatex is a business engaged in fashion for women, men, children, as well as school uniforms, pajamas, and other robes located on Jalan Dr. Sutomo No. 41 Kisaran city. In maintaining more advanced competitiveness,… the company must continue to develop technology, another thing that needs to be considered in making the company more advanced is the relationship with customers which is also an important thing to always maintain. In an effort to manage good relationships with potential customers and customers, companies use Customer Relationship Management (CRM). CRM is a service to customers that is personal, with the aim of providing consistent experience, so that it can provide customer satisfaction, and also get good relationships in the long term. By implementing a good E-CRM, companies will more easily interact with potential customers and customers and provide information according to their needs Customers can also obtain the information they need more quickly and easily. By implementing Customer Relationship Management (CRM) carried out at Anekatex Stores as an effort to improve customer strategies are well proven by the series of processes above and with this application to increase buybacks from total sales every month.

CLUSTERING ROTATIONAL CHURN OF TELECOMMUNICATIONS CUSTOMERS USING A DATA-CENTRICAI APPROACH

Muttaqin, Widang, Lydia, Maya Silvi, Fahmi, Fahmi
Abstract: Abstract: In the current era of very fast technological development, customer churn is a serious challenge, especially in the competitive telecommunications industry. Churn refers to customers who stop using a service or… move to another provider, and can be categorized into three types: Active Churn, Passive Churn, and Rotational Churn. Rotational Churn, which is difficult to predict be- cause the reasons for stopping are unclear, is the main focus of this research. This research aims to group Rotational Churn customers using a Data-Centric AI approach. This approach emphasizes improving data quality through Confident Learning and Synthetic Data before being applied to the K-Means clustering algorithm. The data used in this research is customer churn data from one telecommunications company during 2023. The research results show that customer grouping using the K-Means algorithm can provide deep insight into the characteristics of customer churn. The application of Data-Centric AI is proven to be able to increase the accuracy of clustering models, which ultimately helps compa- nies optimize programs and services to minimize churn and retain customers.       Keywords: data-centric AI; clustering; K-means     Abstrak: Dalam era perkembangan teknologi yang sangat pesat saat ini, churn pelanggan menjadi tantangan serius, terutama dalam industri telekomunikasi yang sangat kompetitif. Churn mengacu pada pelanggan yang berhenti menggunakan layanan atau beralih ke penyedia lain, dan dapat dikategorikan menjadi tiga jenis: Churn Aktif, Churn Pasif, dan Churn Rotasional. Churn Rotasional, yang sulit diprediksi karena alasan penghentian layanan tidak jelas, menjadi fokus utama penelitian ini. Penelitian ini bertujuan untuk mengelompokkan pelanggan Churn Rotasional menggunakan pendekatan Data-Centric AI. Pendekatan ini menekankan pada peningkatan kualitas data melalui Confident Learning dan Synthetic Data sebelum diterapkan ke algoritma K-Means clustering. Data yang digunakan dalam penelitian ini adalah data churn pelanggan dari satu perusahaan telekomunikasi selama tahun 2023. Hasil penelitian menunjukkan bahwa pengelompokan pelanggan menggunakan algoritma K-Means dapat memberikan wawasan mendalam tentang karakteristik churn pelanggan. Penerapan Data-Centric AI terbukti mampu meningkatkan akurasi model klastering, yang pada akhirnya membantu perusahaan mengoptimalkan program dan layanan untuk meminimalkan churn serta mempertahankan pelanggan.   Kata kunci: data-Centric AI; klasterisasi; K-means  

MEASURING THE QUALITY OF DISTRICT GOVERNMENT WEBSITES ONLY USING THE MCCALL AND EUCS METHOD (END USER COMPUTING SATISFACTION)

Riswanto, Ando, Sari, Renny Puspita, Mutiah, Nurul
Abstract: Abstract: Technological developments are currently increasing rapidly, especially in the innovation of information data management. With so many media providing informationand services online, as well as the services provided… vided by the Government of Sekadau Regency in the form of Webstie sekadaukab.go.id. Based on the survey results, the problems experienced by users are output and performance from sekadaukab.go.id still does not meet user expectations. Study this aims to measure the quality of information systems sekadaukab.go.id and also measure the level of user satisfaction with sekadaukab.go.id. By using the method McCall and EUCS (End User Computing Satisfaction) and using methods IPA (Importance Performance Analysis) to map variables into the level of importance and level of performance, the variables used are the variables in the method EUCS (End User Computing Satisfaction). Questionnaires were distributed to 100 users sekadaukab.go.id. The average quality generated by the method McCall of 43.6%, included in the pretty good category. For the results of measuring user satisfaction methods EUCS (End User Computing Satisfaction), each variable is included in the doubtful category range value 2.60 – 3.39. There are 18 recommendations for improvement based on the method McCall and the IPA method to the Kominfo Sekadau Regency against sekadaukab.go.id. Keywords: EUCS; IPA; McCall; public service; quality system     Abstrak:Perkembangan teknologi saat ini semakin pesat, khususnya pada inovasi pengelolaan data informasi. Dengan banyaknya media menyediakan informasi dan pelayanan secara online, begitu juga dengan pelayanan yang disediakan oleh Pemerintah Kabupaten Sekadau berupa Webstie sekadaukab.go.id. Berdasarkan hasil survey, permasalahan yang dialami oleh pengguna yaitu output dan kinerja dari sekadaukab.go.id masih belum memenuhi harapan pengguna. Penelitian ini bertujuan untuk mengukur kualitas dari sistem informasi sekadaukab.go.id dan juga mengukur tingkat kepuasan pengguna terhadap sekadaukab.go.id. Dengan menggunakan metode McCall dan EUCS (End User Computing Satisfaction) serta menggunakan metode IPA (Importance Performance Analysis) untuk memetakan variabel kedalam tingkat kepentingan dan tingkat kinerja, variabel yang digunakan yaitu variabel pada metode EUCS (End User Computing Satisfaction). Kuesioner dibagikan kepada 100 orang pengguna sekadaukab.go.id. Rata- rata kualitas yang dihasilkan berdasarkan metode McCall sebesar 43,6%, masuk kedalam kategori cukup baik. Untuk hasil pengukuran kepuasan pengguna metode EUCS (End User Computing Satisfaction), masing-masing variabel masuk kedalam kategori ragu- ragu dengan range nilai 2.60 – 3.39. Terdapat 18 rekomendasi perbaikan berdasarkan pada metode McCall dan metode IPA kepada pihak Kominfo Kabupaten Sekadau terhadap sekadaukab.go.id.   Kata kunci: EUCS; IPA; kualitas sistem; MCCALL; pelayanan publik