ระบบสนับสนุนการตัดสินใจในการใช้สมุนไพรที่ตอบสนองต่ออาการเจ็บป่วยโดยเทคนิคเหมืองข้อความ
ชื่อผู้แต่งข้างต้นเป็นข้อความจากระเบียนผลงาน ไม่ได้ผูกกับรหัสนักวิจัย จึงกดดูผลงานอื่นของบุคคลนี้ไม่ได้ — ในคลังนี้ 142,080 ผลงาน (63.6% ของทั้งหมด) มีชื่อผู้แต่งที่เชื่อมกับหน้าผู้แต่งได้ และ 60,298 ผลงาน (27.0%) มีผู้แต่งที่ผูกกับรหัสนักวิจัยจริง ส่วนอีก 81,382 ผลงานไม่มีข้อมูลผู้แต่งเลย (มีชื่อผู้แต่งเป็นข้อความอยู่ 142,009 ผลงาน = 63.5%)
บทคัดย่อ
ความเชื่อมั่นต่อสมุนไพรไทยที่สามารถรักษาอาการเจ็บป่วยตามที่ผู้ใช้งานต้องการ เป็นปัจจัยสำคัญในการตัดสินใจเลือกใช้สมุนไพรไทย เพื่อเป็นการส่งเสริมและสร้างความมั่นใจในการใช้สมุนไพรไทยให้ถูกต้องตามสรรพคุณและเหมาะสมกับอาการเจ็บป่วย งานวิจัยนี้จึงได้นำเสนอถึงกระบวนการวิเคราะห์ข้อมูลที่เกี่ยวข้องกับสมุนไพรที่เผยแพร่อยู่บนเว็บไซต์ภาษาไทย ซึ่งเป็นข้อมูลที่มีลักษณะแบบไม่มีโครงสร้าง โดยการประยุกต์ใช้เทคนิคการทำเหมืองข้อความประมวลผลข้อมูลให้มีลักษณะแบบมีโครงสร้าง และวิเคราะห์ข้อมูลโดยการประยุกต์ใช้เทคนิคการค้นหากฏความสัมพันธ์ เพื่อค้นหารูปแบบความสัมพันธ์ระหว่างอาการเจ็บป่วย และสมุนไพรที่ตอบสนองการรักษา โดยผู้วิจัยใช้ข้อมูลจากเว็บไซต์ภาษาไทย 40 เว็บไซต์ และใช้คำสำคัญอาการความเจ็บป่วยจำนวน 377 อาการ และชื่อสมุนไพรจำนวน 994 ชนิด ผู้วิจัยคัดกรองเอกสารจากแหล่งข้อมูลเว็บไซต์ทำให้ได้เอกสารที่เกี่ยวข้องทั้งสิ้น 31,452 เอกสาร โดยผลลัพธ์ที่ได้จากการวิเคราะห์ข้อมูลด้วยเทคนิคดังกล่าวถูกนำเสนอในสองส่วนคือ 1) ผลของการวิเคราะห์ข้อมูลเชิงสารสนเทศ ซึ่งค้นพบว่าในชุดข้อมูลคำสำคัญอาการเจ็บป่วย คำว่า “ติดเชื้อ” ถูกค้นพบจากเอกสารทั้งหมดด้วยความถี่สูงที่สุด ซึ่งคิดเป็นร้อยละ 3.01 ของความถี่ของคำทั้งหมด และรองลงมาคือคำว่า “ปวด”, “มะเร็ง” ถูกค้นพบเป็นร้อยละ 2.90, 2.73 ตามลำดับ สำหรับการวิเคราะห์ในรายการคำสำคัญรายชื่อสมุนไพรพบว่า “ชา” ถูกค้นพบจากเอกสารทั้งหมดด้วยความถี่สูงที่สุด คิดเป็นร้อยละ 5.10 ของความถี่ของคำทั้งหมด และรองลงมาคือ “ขิง”, “มะพร้าว” ถูกค้นพบเป็นร้อยละ 2.65, 2.37 ตามลำดับ 2) ผลของการค้นหากฏความสัมพันธ์ระหว่างคำสำคัญอาการเจ็บป่วย และชื่อสมุนไพร โดยในกระบวนการสร้างกฏความสัมพันธ์ผู้วิจัยกำหนดให้ค่า min-support และค่า min-confidence มีค่าเท่ากับ 50% และ 90% ตามลำดับ ในกระบวนการค้นหากฏความสัมพันธ์ระหว่างชุดของคำสำคัญในชุดเอกสารที่นำมาพิจารณา คณะผู้วิจัยได้นำเสนอการกลั่นกรองคำสำคัญโดยใช้การให้น้ำหนักคำแบบ TF-IDF ซึ่งสามารถกรองคำสำคัญที่ไม่มีนัยยะสำคัญในการเป็นตัวแทนของเอกสารออกไปได้ดีและทำให้การค้นหากฏความสัมพันธ์และความสัมพันธ์ของคำคัญได้ดีขึ้น โดยผลของการศึกษานี้จะถูกใช้เป็นข้อมูลป้อนเข้าสำหรับการพัฒนาระบบสนับสนุนการตัดสินใจฯ โดยระบบสนับสนุนการตัดสินใจที่คณะผู้วิจัยได้ทำการพัฒนาขึ้นมีผลของการประเมินประสิทธิภาพของระบบโดยผู้ใช้ในกลุ่มตัวอย่างเป็นผู้ประเมิน พบผลการประเมินประสิทธิภาพของระบบในภาพรวม มีค่าเฉลี่ยเท่ากับ 4.17 ค่าเบี่ยงเบนมาตรฐานเท่ากับ 0.49 โดยด้านที่มีค่าเฉลี่ยมากที่สุด คือ ด้านการใช้งานระบบ โดยมีค่าเฉลี่ยเท่ากับ 4.23 ค่าเบี่ยงเบนมาตรฐานเท่ากับ 0.57 รองลงมา คือด้านการออกแบบระบบ โดยมีค่าเฉลี่ยเท่ากับ 4.16 ค่าเบี่ยงเบนมาตรฐานเท่ากับ 0.53 และค่าเฉลี่ยด้านที่น้อยที่สุดคือ ด้านเนื้อหา โดยมีค่าเฉลี่ยเท่ากับ 4.13 ค่าเบี่ยงเบนมาตรฐานเท่ากับ 0.49 ตามลำดับ