Audio-visual fuzzy fusion for robust speech recognition

Mario Malcangi; Karim Ouazzane; Pavitra Patel

doi:10.1109/ijcnn.2013.6706789

ScienceGate Book Chapters

JOURNAL ARTICLE

Audio-visual fuzzy fusion for robust speech recognition

Mario Malcangi Karim Ouazzane Pavitra Patel

Year: 2013 Pages: 1-8

DOI: 10.1109/ijcnn.2013.6706789

Get Full-Text PDF Get Analytical Report

Abstract

Improvements of robustness of speech recognition is one of the hottest topics in speech signal processing, particularly when applied within a noisy environment. Most of the research efforts focused in combining audio and visual data to implement an audiovisual speech recognition (AVSR) system. Bimodal approach demonstrated that a superior performance can be gained compared to the separate audio or visual approach. This paper proposes a fuzzy logic-based data fusion method that combines the recognition capabilities of two independent working systems namely the automatic speech recognition system (ASR) and the automatic visual recognition system (AVR). The main purpose is to boost the whole system's performance keeping the ASR separate from the AVR. This approach provides a powerful method that enables simpler data fusion at decision level rather than the more complex at data and features level. Such complexity is also lowered due to the fuzzy logic-based implementation of the data fusion engine. Preliminary experimental results confirms the proposed approach.

Keywords:

Computer science Robustness (evolution) Speech recognition Fuzzy logic Audio visual Sensor fusion Speech processing Artificial intelligence Speech coding Speaker recognition Pattern recognition (psychology)

Metrics

Cited By

0.89

FWCI (Field Weighted Citation Impact)

Refs

0.77

Citation Normalized Percentile

Is in top 1%

Is in top 10%

Citation History

Topics

Speech and Audio Processing

Physical Sciences → Computer Science → Signal Processing

Blind Source Separation Techniques

Physical Sciences → Computer Science → Signal Processing

Advanced Data Compression Techniques

Physical Sciences → Computer Science → Computer Vision and Pattern Recognition

Audio-visual fuzzy fusion for robust speech recognition

Abstract

Metrics

Citation History

Topics

Related Documents

Robust Audio-Visual Speech Recognition Based on Hybrid Fusion

Fuzzy-Neural-Network Based Audio-Visual Fusion for Speech Recognition

Towards Robust Audio-Visual Speech Recognition

Robust Sensor Fusion: Analysis and Application to Audio Visual Speech Recognition

Robust Self-Supervised Audio-Visual Speech Recognition