Kamus Kata Tidak Baku Beserta Kode Program Implementasi untuk Preprocessing Data Teks
Kamus Kata Tidak Baku Beserta Kode Program Implementasi untuk Preprocessing Data Teks Dalam paket ini, Anda akan memperoleh kamus kata tidak baku beserta kode program siap pakai untuk proses text preprocessing dan scraping data komentar YouTube.
Fitur yang Tersedia
๐ Scraping data komentar YouTube menggunakan YouTube Data API v3.
๐งน Text preprocessing yang mencakup:
-Cleaning
-Case Folding
-Normalisasi Kata
-Tokenization
-Stopword Removal
๐ Penambahan stopword manual dan kamus normalisasi kata tidak baku untuk mempermudah penanganan data teks yang memiliki variasi penulisan.
โ๏ธ Visualisasi WordCloud hasil preprocessing.
๐ Analisis frekuensi kata sebelum dan sesudah preprocessing.
๐ Implementasi analisis n-gram, meliputi:
-Unigram
-Bigram
-Trigram
Seluruh kode program telah disusun agar mudah digunakan untuk kebutuhan penelitian, analisis sentimen, text mining, dan pengolahan data teks pada berbagai platform digital.
Referensi
๐ Tutorial Scraping Komentar YouTube menggunakan YouTube Data API v3.
๐ Dataset Kamus Kata Tidak Baku.
๐ Repository GitHub Kamus Kata Tidak Baku.