ระบบอัตโนมัติสำหรับสกัดคำนามประสมในประโยคภาษาไทย

ณิชชา บำรุง

Description

วิทยานิพนธ์ฉบับนี้นำเสนอระบบอัตโนมัติสำหรับสกัดคำนามประสมในประโยคภาษาไทยโดยระบบประกอบด้วยสี่ส่วน คือ การประมวลผลก่อน การวิเคราะห์คำนามประสมโดยใช้รูปแบบ การวิเคราะห์คำนามประสมถาวร และ การวิเคราะห์คำนามประสมโดยใช้ความหมาย โดยการหาหน้าที่ของคำของประโยคแต่ละประโยคจะใช้โปรแกรม swath เป็นตัวติดป้ายแบ่งแยกโครงสร้างของคำแต่ละคำซึ่งหน้าที่ของคำแต่ละคำและจะมีการพิจารณาคำแต่คำด้วยกฎขอไวยากรณ์ ซึ่งเป็นกฏสำหรับคำนามประสมที่ได้มาจากผู้เชี่ยวชาญโดยคำที่ตรงกันตามกฎจะถือว่าเป็นคำนามประสมจากนั้นจึงจะเข้าสู่การขั้นตอนแรกซึ่งเป็นการตรวจสอบคำนามประสมโดยนำคำที่ได้จากกฎจากข้างต้นมาตรวจสอบกับพจนานุกรม กรณีที่พบคำนามประสมในพจนานุกรมจะนับว่าเป็น “permanent compound noun” ส่วนกรณีที่ไม่พบคำนามประสมในพจนานุกรมต้องเข้าสู่ขั้นตอนที่สองการพิจารณาคำนามประสมซึ่งประกอบด้วยสี่ขั้นตอนด้วยกันคือความสัมพันธ์แบบจ่ากลุ่ม-ลูกกลุ่ม คำนามประสมไม่สามารถแยกได้ คำนามประสมสลับที่ไม่ได้ และ ไม่มีความเป็นเจ้าของ กรณีที่พบทั้งสี่ขั้นตอนจะถือว่าเป็นคำนามประสม จากการทดลองคำที่นำมาตรวจสอบจะต้องผ่านส่วนที่ 1, 2, และ 3 หรือ 4 ถึงจะสามารถสรุปได้ว่าคำที่นำมาตรวจสอบเป็นคำนามประสม การทดลองเป็นการใช้บทความจากสารานุกรมของคลังข้อความภาษาไทย BEST Corpus Training Set 1 Release 3 ของศูนย์เทคโนโลยีอิเล็กทรอนิกส์และคอมพิวเตอร์แห่งชาติ เป็นตัวทดสอบประสิทธิภาพซึ่งจากผลการทดสอบได้ค่าความครบถ้วนเป็น 55.38% และ ค่าความแม่นยำเป็น 41.38%

Citations (0)

Mentions (0)

Metrics

Dataset Index

0.3

FAIR Score

58%

Citations

0

Mentions

0

Metrics Over Time

Publication Details

DOI

Publisher

มหาวิทยาลัยธรรมศาสตร์

Assigned Domain

Subfield

Language and Linguistics

Field

Arts and Humanities

Domain

Social Sciences

Confidence Score

45%

Source

Scholar Data Model

Keywords

คำนามประสมภาษาไทยคำนามประโยคThai compound nouns analysisAutomatic compound noun extractionsystemPermanent compound nounSemantic-based criteriaSuperordinate-subordinate semantic

Normalization Factors

FT

65.38

CTw

1.00

MTw

1.00