Search engine for discovering works of Art, research articles, and books related to Art and Culture
ShareThis
Javascript must be enabled to continue!

PENGUKURAN KEMIRIPAN KALIMAT BAHASA INDONESIA MENGGUNAKAN REPRESENTASI WORD EMBEDDING FASTTEXT

View through CrossRef
Pengukuran kemiripan kalimat merupakan komponen penting dalam berbagai aplikasi pemrosesan bahasa alami (NLP), seperti pencarian semantik, sistem tanya jawab, dan deteksi plagiarisme. Penelitian ini bertujuan untuk mengevaluasi kemampuan model word embedding FastText dalam mengukur kemiripan semantik antar kalimat berbahasa Indonesia. Dataset yang digunakan adalah Semantic Textual Similarity Benchmark (STS-B) versi Bahasa Indonesia, yang memuat pasangan kalimat beserta skor kemiripan berdasarkan penilaian manusia. Setiap kalimat direpresentasikan sebagai rata-rata vektor dari kata-kata penyusunnya menggunakan model FastText pralatih untuk Bahasa Indonesia. Kemiripan antar kalimat dihitung menggunakan cosine similarity, dan hasilnya dibandingkan dengan skor referensi manusia menggunakan korelasi Pearson dan Spearman. Hasil evaluasi menunjukkan bahwa FastText mampu menangkap sebagian besar makna semantik antar kalimat, dengan nilai korelasi Pearson sebesar 0.3658 dan Spearman sebesar 0.4260. Meskipun demikian, hasil tersebut mengindikasikan bahwa pendekatan berbasis word-level embedding seperti FastText memiliki keterbatasan dalam memahami konteks yang lebih kompleks. Penelitian ini memberikan gambaran awal mengenai efektivitas FastText dalam tugas pengukuran similarity semantik untuk Bahasa Indonesia dan membuka peluang pengembangan metode representasi yang lebih kontekstual di masa depan.
Title: PENGUKURAN KEMIRIPAN KALIMAT BAHASA INDONESIA MENGGUNAKAN REPRESENTASI WORD EMBEDDING FASTTEXT
Description:
Pengukuran kemiripan kalimat merupakan komponen penting dalam berbagai aplikasi pemrosesan bahasa alami (NLP), seperti pencarian semantik, sistem tanya jawab, dan deteksi plagiarisme.
Penelitian ini bertujuan untuk mengevaluasi kemampuan model word embedding FastText dalam mengukur kemiripan semantik antar kalimat berbahasa Indonesia.
Dataset yang digunakan adalah Semantic Textual Similarity Benchmark (STS-B) versi Bahasa Indonesia, yang memuat pasangan kalimat beserta skor kemiripan berdasarkan penilaian manusia.
Setiap kalimat direpresentasikan sebagai rata-rata vektor dari kata-kata penyusunnya menggunakan model FastText pralatih untuk Bahasa Indonesia.
Kemiripan antar kalimat dihitung menggunakan cosine similarity, dan hasilnya dibandingkan dengan skor referensi manusia menggunakan korelasi Pearson dan Spearman.
Hasil evaluasi menunjukkan bahwa FastText mampu menangkap sebagian besar makna semantik antar kalimat, dengan nilai korelasi Pearson sebesar 0.
3658 dan Spearman sebesar 0.
4260.
Meskipun demikian, hasil tersebut mengindikasikan bahwa pendekatan berbasis word-level embedding seperti FastText memiliki keterbatasan dalam memahami konteks yang lebih kompleks.
Penelitian ini memberikan gambaran awal mengenai efektivitas FastText dalam tugas pengukuran similarity semantik untuk Bahasa Indonesia dan membuka peluang pengembangan metode representasi yang lebih kontekstual di masa depan.

Related Results

Analisis Kontrastif Struktur Kalimat Bahasa Arab dan Bahasa Bugis
Analisis Kontrastif Struktur Kalimat Bahasa Arab dan Bahasa Bugis
 هذه الأطروحة تبحث عن تحليل التقابلى فى تركيب جمل اللغة العربية و اللغة البوغيسية ، خاصة في أنماط  و أنواع جمل اللغة العربية  و اللغة البوغيسية. هذه الأطروحة تهدف إلى: 1) وصف أنماط...
KALIMAT BAHASA SUNDA DALAM TEKS PROSA SUNDA KUNO ABAD KE-16 (Analisis Struktur dan Semantis)
KALIMAT BAHASA SUNDA DALAM TEKS PROSA SUNDA KUNO ABAD KE-16 (Analisis Struktur dan Semantis)
Penelitian ini memiliki tujuan untuk menganalisis struktur kalimat dengan menggunakan pendekatan tagmémik. Sumber data diambil dari transliterasi teks Carita Parahiyangan yang mema...
KALIMAT MINOR PADA DIALOG NOVEL UTARA KARYA BAYU PERMANA: KAJIAN SASTRA
KALIMAT MINOR PADA DIALOG NOVEL UTARA KARYA BAYU PERMANA: KAJIAN SASTRA
Abstrak Penelitian ini bertujuan mendeskripsikan penggunaan kalimat minor pada dialog novel Utara karya Bayu Permana. Aspek-aspek yang di deskripsikan adalah jenis kalimat minor d...
Evaluasi Pengukuran Semantik Sinonim KBBI Menggunakan Pendekatan Word Embedding
Evaluasi Pengukuran Semantik Sinonim KBBI Menggunakan Pendekatan Word Embedding
Kamus Besar Bahasa Indonesia (KBBI) ialah salah satu sumber utama penyedia data dalam penelitian penentuan kemiripan makna kata dalam bahasa Indonesia. Penelitian ini membahas cara...
SISTEM INVERSI DALAM BAHASA INGGRIS
SISTEM INVERSI DALAM BAHASA INGGRIS
Penelitian ini membahas masalah-masalah pokok yang terkait dengan struktur inversi dalam bahasa inggris yaitu: 1. Ada berapa jenis inversi?, 2. Kalimat-kalimat yang bagaimana yang ...
PELESAPAN FUNGSI SINTAKSIS DALAM KALIMAT MAJEMUK BAHASA INDONESIA
PELESAPAN FUNGSI SINTAKSIS DALAM KALIMAT MAJEMUK BAHASA INDONESIA
Tujuan penelitian ini adalah (1) mendeskripsikan jenis fungsi sintaksis yang dilesapkan dalam kalimat majemuk bahasa Indonesia, (2) mendeskripsikan kategori sintaksis yang menjadi ...
ANALISIS KEEFEKTIFAN KALIMAT DALAM MAJALAH WARTA USK
ANALISIS KEEFEKTIFAN KALIMAT DALAM MAJALAH WARTA USK
ABSTRAK Penelitian analisis keefektifan kalimat dalam majalah Warta USK ini bertujuan untuk mengetahui bentuk-bentuk kalimat tidak efektif yang terdapat di dalam majalah Warta USK....
ANALISIS KALIMAT MAJEMUK BAHASA INDONESIA DALAM TEKS ILMIAH SEBAGAI BAHAN PENGAYAAN MATA KULIAH SINTAKSIS
ANALISIS KALIMAT MAJEMUK BAHASA INDONESIA DALAM TEKS ILMIAH SEBAGAI BAHAN PENGAYAAN MATA KULIAH SINTAKSIS
Penelitian ini dilakukan untuk mewujudkan bahan pembelajaran berbasis penelitian. Yang dimaksudkan bahan pembelajaran berbasis penelitian adalah bahan pembelajaran yang dikembangka...

Back to Top