Description
วิทยานิพนธ์ฉบับนี้นำเสนอระบบอัตโนมัติสำหรับสกัดคำนามประสมในประโยคภาษาไทยโดยระบบประกอบด้วยสี่ส่วน คือ การประมวลผลก่อน การวิเคราะห์คำนามประสมโดยใช้รูปแบบ การวิเคราะห์คำนามประสมถาวร และ การวิเคราะห์คำนามประสมโดยใช้ความหมาย โดยการหาหน้าที่ของคำของประโยคแต่ละประโยคจะใช้โปรแกรม swath เป็นตัวติดป้ายแบ่งแยกโครงสร้างของคำแต่ละคำซึ่งหน้าที่ของคำแต่ละคำและจะมีการพิจารณาคำแต่คำด้วยกฎขอไวยากรณ์ ซึ่งเป็นกฏสำหรับคำนามประสมที่ได้มาจากผู้เชี่ยวชาญโดยคำที่ตรงกันตามกฎจะถือว่าเป็นคำนามประสมจากนั้นจึงจะเข้าสู่การขั้นตอนแรกซึ่งเป็นการตรวจสอบคำนามประสมโดยนำคำที่ได้จากกฎจากข้างต้นมาตรวจสอบกับพจนานุกรม กรณีที่พบคำนามประสมในพจนานุกรมจะนับว่าเป็น “permanent compound noun” ส่วนกรณีที่ไม่พบคำนามประสมในพจนานุกรมต้องเข้าสู่ขั้นตอนที่สองการพิจารณาคำนามประสมซึ่งประกอบด้วยสี่ขั้นตอนด้วยกันคือความสัมพันธ์แบบจ่ากลุ่ม-ลูกกลุ่ม คำนามประสมไม่สามารถแยกได้ คำนามประสมสลับที่ไม่ได้ และ ไม่มีความเป็นเจ้าของ กรณีที่พบทั้งสี่ขั้นตอนจะถือว่าเป็นคำนามประสม จากการทดลองคำที่นำมาตรวจสอบจะต้องผ่านส่วนที่ 1, 2, และ 3 หรือ 4 ถึงจะสามารถสรุปได้ว่าคำที่นำมาตรวจสอบเป็นคำนามประสม การทดลองเป็นการใช้บทความจากสารานุกรมของคลังข้อความภาษาไทย BEST Corpus Training Set 1 Release 3 ของศูนย์เทคโนโลยีอิเล็กทรอนิกส์และคอมพิวเตอร์แห่งชาติ เป็นตัวทดสอบประสิทธิภาพซึ่งจากผลการทดสอบได้ค่าความครบถ้วนเป็น 55.38% และ ค่าความแม่นยำเป็น 41.38%
Citations (0)
No citations found
Mentions (0)
No mentions found
Metrics Over Time
Publication Details
Subfield
Language and Linguistics
Field
Arts and Humanities
Domain
Social Sciences
Confidence Score
45%
Source
Scholar Data Model