Text
NLP Pribumi (Algoritma Stemming Rejang)
Natural Language Processing (NLP) atau Pemrosesan Bahasa Alami, merupakan salah satu cabang dari ilmu Kecerdasan Buatan atau Artificial Intelligence (AI) yang berfokus pada pengolahan bahasa alami. Bahasa alami merupakan bahasa yang secara umum digunakan oleh manusia dalam komunikasi antara satu dengan lainnya. Bahasa yang diterima oleh komputer membutuhkan suatu proses dan dapat dipahami terlebih dahulu agar maksud dari pengguna dapat dipahami dengan baik oleh komputer. Tujuan dari Pemrosesan bahasa alami adalah untuk melakukan pengolahan bahasa dan pemahaman yang hampir serupa dengan kinerja manusia. Tujuan itu belum sepenuhnya tercapai karena untuk memahami bahasa sebuah sistem harus mampu untuk: mengutip sebuah input teks, menerjemahkan teks ke dalam bahasa lain, menjawab pertanyaan tentang isi teks, menarik kesimpulan dari teks.
Text Preprocessing merupakan tahap awal dalam metode NLP untuk dokumen yang berupa teks (NLP for Text). Text Preprocessing mempersiapkan teks yang tidak terstruktur menjadi data yang baik dan siap untuk diolah. Ada berbagai proses yang dapat digunakan dalam tahap Text Preprocessing. Tidak ada aturan yang baku mengenai proses apa saja serta urutan yang digunakan dalam tahap Text Preprocessing. Semua tergantung dari output yang diinginkan dari data tersebut. Proses yang dapat dilakukan pada Text Preprocessing adalah Parsing, Case Folding, Tokenizing, Stemming, dan Filtering. Salah satu contoh dari proses Text Preprocessing adalah Stemming Rejang. Algoritma Stemming Rejang merupakan algoritma Stemming untuk bahasa Rejang yang terdapat pada Provinsi Bengkulu, yang terdiri dari proses menghilangkan awalan, sisipan, dan akhiran. Algoritma Stemming Rejang bertujuan untuk melihat seberapa besar Overstemming dan Understemming yang dihasilkan dari proses Stemming tersebut.
Berikut Daftar Isinya:
- Kecerdasan Buatan
- Pemrosesan Bahasa Alami
- Parsing
- Case Folding
- Tokenization
- Stemming
- Filtering
- Stemming Rejang
Tidak tersedia versi lain