Dashboard
Total Data Dataset
5621
Sudah Dipreprocessing
5621
Sudah Berlabel
5621
Total Percobaan Training
7
Model Terbaik (Akurasi)
Random Forest (71.1%)
Distribusi Sentimen Dataset
Perbandingan Akurasi Terakhir
Alur Kerja Sistem
1. Upload Data Mentah
Upload CSV hasil scraping/gabungan (label tidak wajib ada).
2. Preprocessing
Cleaning, case folding, normalisasi, tokenizing, dan stopword removal.
3. Pelabelan Data
Label otomatis berbasis kamus sentimen (lexicon-based), bisa dikoreksi manual.
4. Training Model
Ekstraksi fitur TF-IDF lalu latih model Random Forest dan KNN dari UI.
5. Evaluasi & Uji Coba
Bandingkan akurasi, precision, recall, F1-score, dan uji prediksi teks baru.