Command Palette

Search for a command to run...

กลับไปผลการค้นหา
รายงานฉบับสมบูรณ์พ.ศ. 2564

การแบ่งส่วนของเสียงพยางค์โดดสำหรับการรู้จำเสียงพูดด้วยการเรียนรู้เชิงลึก

โสภณ วิริยะรัตนกุล มหาวิทยาลัยราชภัฏอุตรดิตถ์ พ.ศ. 2564

ชื่อผู้แต่งข้างต้นเป็นข้อความจากระเบียนผลงาน ไม่ได้ผูกกับรหัสนักวิจัย จึงกดดูผลงานอื่นของบุคคลนี้ไม่ได้ — ในคลังนี้ 142,080 ผลงาน (63.6% ของทั้งหมด) มีชื่อผู้แต่งที่เชื่อมกับหน้าผู้แต่งได้ และ 60,298 ผลงาน (27.0%) มีผู้แต่งที่ผูกกับรหัสนักวิจัยจริง ส่วนอีก 81,382 ผลงานไม่มีข้อมูลผู้แต่งเลย (มีชื่อผู้แต่งเป็นข้อความอยู่ 142,009 ผลงาน = 63.5%)

บทคัดย่อ

งานวิจัยนี้เป็นการแบ่งส่วนของเสียงพยางค์โดดสำหรับการรู้จำเสียงพูดด้วยการเรียนรู้เชิงลึก โดยการศึกษาค่าคุณลักษณะสำคัญ ของสัญญาณเสียงพูดในแกนเวลาและนำมาใช้ร่วมกับค่าคุณลักษณะของสัญญาณเสียงพูดในแกนความถี่เพื่อใช้เป็นค่าคุณลักษณะสำคัญสำหรับการรู้จำสัญญาณเสียงพูดด้วยการเรียนรู้เชิงลึก ในงานวิจัยนี้ได้นำวิธีการแบ่งสัญญาณเสียงออกเป็นเฟรมด้วยวิธีการ Short-time Energy Waveform ทำให้ได้ ตำแหน่งของ Pitch marker เป็นตำแหน่งอ้างอิงของการแบ่งเฟรมสัญญาณเสียงออกเป็นส่วนๆ สำหรับนำไปใช้หาค่าคุณลักษณะสำคัญ ด้วยวิธีการ Window searching ที่ค้นหาค่าตำแหน่งและค่าแอมพลิจูดของ Local minimum & Local maximum และ Max slope เพื่อใช้เป็นค่าคุณลักษณะสำคัญในโดเมนเวลาส่วนค่าคุณลักษณะสำคัญในแกน ได้ใช้ค่าสัมประสิทธิ์เซปตรัมบนเมลสเกลจากค่าคุณลักษณะสำคัญในแกนเวลาและแกนความถี่ ได้นำมาทำการรู้จำสัญญาณเสียงด้วยโครงข่ายใยประสาทเทียมพร้อมกับเปรียบเทียบค่าคุณลักษณะสำคัญในแกนเวลาและแกนความถี่ ด้วยการนำมาร่วมกันและแยกกันกับโครงข่ายใยประสาทเทียมพบว่าการรู้จำสัญญาณเสียงโดยใช้โครงข่ายประสาทเทียมที่มีชั้นนำเข้าอยู่ 2 ชั้นและมีชั้นซ่อนเดียวกันเพื่อเชื่อมกันกับชั้นนำเข้าทั้ง 2 นั้น ที่มีชั้นนำเข้าเป็นข้อมูลของ MFCC และค่าคุณลักษณะสำคัญในโดเมนเวลา ให้ผลการรู้จำสัญญาณเสียงที่ดีที่สุดในงานวิจัยนี้อยู่ที่ร้อยละ 96.97 และ Blind Test เป็น 88.43

คำสำคัญ

Deep learningSpeech recognitionรู้จำเสียงพูดเรียนรู้เชิงลึก

งานวิจัยในหัวข้อใกล้เคียง

การวัดค่าสัมประสิทธิ์การดูดกลืนเชิงเส้นของเสียงเพื่อการบูรณาการการเรียนการสอนรายวิชาสวนศาสตร์

ฐนสพล ปรีชาญาณ มหาวิทยาลัยราชภัฏหมู่บ้านจอมบึง พ.ศ. 2553

การพัฒนาทักษะในการจำแนกคุณลักษณะเสียงสูง-ต่ำของตัวโน้ตโดยการใช้สัญลักษณ์มือแทนระดับเสียงตัวโน้ตตามแนวการสอนของโคดาย

พัฒน์ณรี ลีวิวัฒนโชต พ.ศ. 2560

วิเคราะห์สระเสียงสั้นจากอีกแง่มุมหนึ่ง

เต๋อติ่ง พัน มหาวิทยาลัยปักกิ่ง พ.ศ. 2561

โครงการการรู้จำเสียงร้องที่ไม่ขึ้นกับเสียงรบกวนพื้นหลังโดยใช้ แบบรูปสเปกโทรแกรมเชิงภาพ

พีระพล ขุนอาสา มหาวิทยาลัยราชภัฏอุตรดิตถ์ พ.ศ. 2559

การประเมินผลการใส่ท่อหายใจทางปาก โดยใช้การจำแนกภาพกล่องเสียงแบบใหม่เป็นแนวทาง

รยากร กันทา มหาวิทยาลัยเชียงใหม่ พ.ศ. 2552

โครงการ แพลตฟอร์มการทดลองสำหรับการสร้างแบบจำลองสัทสัมพันธ์เสียง: จากทฤษฎีสู่การปฏิบัติ

สันติธรรม พรหมอ่อน มหาวิทยาลัยเทคโนโลยีพระจอมเกล้าธนบุรี พ.ศ. 2558

Convolutional neural network and feature transformation for distant speech recognition

พ.ศ. 2561

การพัฒนาทักษะกระบวนการทางวิทยาศาสตร์และผลสัมฤทธิ์ทางการเรียน เรื่อง เสียงกับการได้ยิน โดยใช้การจัดกิจกรรมการเรียนรู้แบบร่วมมือเทคนิค STAD ร่วมกับผังมโนทัศน์ ของนักเรียนชั้นประถมศึกษาปีที่ 5

อนันต์ ปานศุภวัชร มหาวิทยาลัยราชภัฏสกลนคร พ.ศ. 2562

Compressed sensing speech signal enhancement research

พ.ศ. 2560

การรับรู้เสียงพูดอันนำไปสู่การแรกรับภาษา: ผลการศึกษาจากเบบี้แล็บ

อทิตา อมรลักษณานนท์ มหาวิทยาลัยธรรมศาสตร์ พ.ศ. 2563