0% menganggap dokumen ini bermanfaat (0 suara)
5 tayangan9 halaman

Pengenalan Natural Language Processing

Diunggah oleh

Yunita Anggeraini
Hak Cipta
© All Rights Reserved
Kami menangani hak cipta konten dengan serius. Jika Anda merasa konten ini milik Anda, ajukan klaim di sini.
Format Tersedia
Unduh sebagai PDF, TXT atau baca online di Scribd
0% menganggap dokumen ini bermanfaat (0 suara)
5 tayangan9 halaman

Pengenalan Natural Language Processing

Diunggah oleh

Yunita Anggeraini
Hak Cipta
© All Rights Reserved
Kami menangani hak cipta konten dengan serius. Jika Anda merasa konten ini milik Anda, ajukan klaim di sini.
Format Tersedia
Unduh sebagai PDF, TXT atau baca online di Scribd

ACC 80

6/11/2024

Tanggal Asistensi :

Tanda Tangan Nilai

MODUL I
Natural Language
Processing

Nama : Muh. Al Faiz

Nim : F55123085

Kelas : TI C
BAB II
LANDASAN TEORI
2.1 Teori Dasar
2.1.1 Natural Language Processing
Natual Language Processing (NLP) atau pengolahan bahasa alami
(PBA) merupakan salah satu bidang ilmu kecerdasan buatan (artificial
intelligence) yang mempelajari komunikasi antara manusia dengan
komputer. Natural Languange adalah sebuah bahasa yang diucapkan, ditulis
oleh manusia untuk berkomunikasi. Bahasa adalah sebuah sistem yang
terdiri atas kumpulan simbol dan aturan (grammar). Natural language
processing mencakup semua yang diperlukan komputer untuk mengerti.
Bahasa Alami baik yang ditulis maupun diucapkan dan menghasilkan
sebuah bahasa alami. NLP terdiri terdiri dari dua yaitu :
1. Natural Language Understanding (NLU).
Tugas NLU adalah memahami input (bahasa alami).
2. Natural Language Generation (NLG).
NLG adalah salah satu bagian dari NLP, NLG sering juga disebut text
generation.

Berikut ini dijelaskan bidang-bidang pengetahuan yang berhubungan


dengan NLP:
1. Fonetik dan fonologi: berhubungan dengan suara yang menghasilkan
kata yang dapat dikenali.. Bidang ini menjadi penting dalam proses
aplikasi yang memakai metode speech based system. Dalam bidang ini,
NLP menggunakan metode pengenalan suara untuk mengubah ucapan
menjadi teks, dimana fonetik dan fonologi membantu memastikan kata
dikenali dengan benar, terlepas dari variasi suara.
2. Morfologi: yaitu pengetahuan tentang kata dan bentuknya dimanfaatkan
untuk membedakan satu kata dengan lainnya. Bidang ini membantu
mengidentifikasi akar kata, elemen lain seperti tanda baca yang ada
didalam kalimat.
3. Sintaksis: yaitu pemahaman tentang urutan kata dalam pembentukan
kalimat dan hubungan antar kata tersebut dalam proses perubahan
bentuk dari kalimat menjadi bentuk yang sistematis. Bidang ini dapat
menganalisis atau mengidentifikasi tata bahasa, seperti mengenali
subjek, predikat, objek yang salah pada kalimat. Selain mendeteksi
kesalahan tata bahasa, sintaksis juga dapat mengusulkan pengurutan
ulang kata yang benar atau bahkan memperbaiki kesalahan tata bahasa.
4. Semantik: yaitu pemetaan bentuk struktur sintaksis dengan
memanfaatkan tiap kata ke dalam bentuk yang lebih mendasar dan tidak
tergantung struktur kalimat. Semantik mempelajari arti suatu kata dan
bagaimana dari arti kata tersebut membentuk suatu arti dari kalimat
yang utuh. Dalam tingkatan ini belum tercakup konteks dari kalimat
tersebut.
5. Pragmatik: pengetahuan pada tingkatan ini berkaitan dengan masing-
masing konteks yang berbeda tergantung pada situasi dan tujuan
pembuatan sistem. Bidang ini sangat berguna didalam NLP karena
membantu mendeteksi nuansa bahasa seperti sarkasme, humor, dan
makna implisit yang tergantung pada situasi.
6. Discourse Knowledge: melakukan pengenalan apakah suatu kalimat
yang sudah dibaca dan dikenali sebelumnya akan mempengaruhi arti
dari kalimat selanjutnya. Informasi ini penting diketahui untuk
melakukan pengolahan arti terhadap kata ganti orang dan untuk
mengartikan aspek sementara dari informasi.
7. World Knowledge: mencakup arti sebuah kata secara umum dan apakah
ada arti khusus bagi suatu kata dalam suatu percakapan dengan konteks
tertentu. Bidang ini dapat memberikan konteks tambahan tentang
pengetahuan umum atau pemahaman tentang dunia.
BAB III
PROSEDUR KERJA
3.1 Langkah Kerja
3.1.1 Natural Language Processing
1. Memulai Goggle Colab
a. Search Goggle Colab di Goggle, klik Goggle Colab

b. Maka akan tampil halaman seperti ini, lalu tekan open colab

c. Lalu klik Notebook baru untuk membuat file baru


d. Klik Untitled untuk mengubah file

e. Ubah nama file menjadi Percobaan 1

f. Tekan tanda “+teks” untuk menambahkan teks

2. Memulai Coding di google colab


a. Klik tanda ”+kode” untuk memunculkan kolom untuk kode
b. Jika tampilannya seperti ini, selanjutnya masukan kode

3. Latihan Tokenisasi
a. Ketik code seperti berikut, dengan menggunakan paragraf
pertama text seperti pada gambar dibawah.

b. Kemudian untuk melihat apakah variabel text sudah berjalan


dengan benar, maka kita panggil variabel text di line
kemudian run, maka hasilnya akan muncul yang
menunjukkan bahwa variable text sudah terbaca.

c. Lalu, ketikkan kode seperti dibawah ini.


d. Kemudian setelah di run maka hasilnya akan seperti di
bawah

4. Menghitung Frekuensi Kata pada Text


a. Kode ini. Tujuannya adalah untuk melihat berapa banyak
frekuensi keluarnya setiap huruf pada text yang kita punya

b. Ketika di run maka hasilnya akan seperti gambar di bawah.


BAB IV
HASIL DAN PEMBAHASAN
4.1 Hasil Dan Pembahasan
4.1.1 Natural Language Processing
1. Output dari Tokenisasi

Baris pertama pada program berguna untuk mengubah semua


huruf yang ada pada teks menjadi huruf kecil. Lalu, ada fungsi
“[Link]” yang digunakan untuk mengganti semua karakter selain
huruf (A-Z, a-z), angka (0-9), garis miring(/), dan titik(.) menjadi
spasi. Kemudian ada fungsi “[Link]” untuk memisahkan
berdasarkan spasi, dan hasilnya disimpan dalam variabel token.
2. Output Frekuensi Kata pada Text.

Program ini melakukan perulangan “for” untuk menghitung


frekuensi atau jumlah kemunculan kata dan hasilnya akan
disimpan pada dictionary “frekuensikata”. Lalu, mengambil
daftar kata kunci dari dictionary “frekuensikata” untuk iterasi
berikutnya.
BAB V
PENUTUP
5.1 Kesimpulan
5.1.1 Natural Language Processing
Pada modul ini, mahasiswa mulai mengetahui bahwa natural
language processing (NLP) atau pengolahan bahasa alami (PBA)
merupakan salah satu bidang ilmu kecerdasan buatan (artificial
intelligence) yang mempelajari komunikasi antara manusia dengan
komputer. Ada juga beberpaa bidang yang berhubungan dengan natual
language processing yaitu fonetik dan fonologi, morfologi, sintaksis,
semantik, pragmatik, discourse knowledge, dan world knowledge.

Anda mungkin juga menyukai