Giới thiệu về Hệ thống Phân loại Âm thanh trong Máy trợ thính Lấy cảm hứng từ Phân tích Cảnh âm thanh
Nghiên cứu này giới thiệu một hệ thống phân loại âm thanh tiên tiến, được thiết kế đặc biệt để nhận dạng tự động môi trường âm thanh trong máy trợ thính. Hệ thống có khả năng phân biệt bốn lớp âm thanh chính bao gồm: "ngôn ngữ rõ ràng", "ngôn ngữ trong môi trường nhiễu", "nhiễu" và "nhạc".
Để đạt được độ chính xác cao, các đặc trưng âm thanh độc đáo đã được trích xuất từ tín hiệu âm thanh, dựa trên nguyên tắc phân tích cảnh âm thanh của con người. Các đặc trưng này bao gồm biến đổi biên độ, hồ sơ phổ, tính hài hòa, điểm bắt đầu và nhịp điệu. Sau đó, một loạt các bộ phân loại mẫu khác nhau đã được đánh giá, từ các phương pháp đơn giản như dựa trên luật và khoảng cách tối thiểu, đến các kỹ thuật phức tạp hơn như bộ phân loại Bayes, mạng nơ-ron và mô hình Markov ẩn.
Hệ thống được huấn luyện và kiểm tra trên một cơ sở dữ liệu âm thanh quy mô lớn. Kết quả cho thấy tỷ lệ nhận dạng cao, tuy nhiên, lớp "ngôn ngữ trong môi trường nhiễu" đặt ra một thách thức. Nghiên cứu cũng chỉ ra những khó khăn trong việc phân loại nhạc pop nén, tiếng nói có âm vang mạnh và các loại tiếng ồn biến động hoặc dao động.
Mục lục chi tiết:
- 1. INTRODUCTION
- 2. SOUND CLASSIFICATION INSPIRED BY AUDITORY SCENE ANALYSIS
- 2.1. Auditory scene analysis
- 2.2. Features for sound classification
- 2.3. Pattern classifiers
- 2.4. Postprocessing
- 3. EVALUATION OF DIFFERENT CLASSIFICATION SYSTEMS
- 3.1. Motivation
- 3.2. Sound database
- 3.3. Procedure
- 3.4. Results
- 3.5. Discussion
- 4. CONCLUSIONS