nach oben

Erschienen in:

2012 | OriginalPaper | Buchkapitel

Performance Evaluation of PBDP Based Real-Time Speaker Identification System with Normal MFCC vs MFCC of LP Residual Features

verfasst von : Soma Khan, Joyanta Basu, Milton Samirakshma Bepari

Erschienen in: Perception and Machine Intelligence

Verlag: Springer Berlin Heidelberg

Einloggen

Aktivieren Sie unsere intelligente Suche, um passende Fachinhalte oder Patente zu finden.

search-config

KI-gestützte Suche

Aus

Present study compares, Mel Frequency Cepstral Coefficients (MFCC) of Linear Predictive (LP) Residuals with normal MFCC features using both VQ and GMM based speaker modeling approaches for performance evaluation of real- time Automatic Speaker Identification systems including both co-operative and non co-operative speaking scenario. Pitch Based Dynamic Pruning (PBDP) technique is applied regarding optimization of Speaker Identification process. System is trained and tested with voice samples of 62 speakers across different age groups. Residual of a signal contains information mostly about the source, which is speaker specific. Result shows that, in co-operative speaking, MFCC of LP residuals outperform normal MFCC features for both VQ and GMM based speaker modeling with an improvement of 7.6% and 6.8% in average accuracy respectively. But combined modeling of both features (source and vocal tract) is required for non co-operative speaking in real-time as it enhances the highest identification accuracy from 67.7% to 83%.

Sie haben noch keine Lizenz? Dann Informieren Sie sich jetzt über unsere Produkte:

Springer Professional "Wirtschaft+Technik"

Online-Abonnement

Mit Springer Professional "Wirtschaft+Technik" erhalten Sie Zugriff auf:

über 102.000 Bücher
über 537 Zeitschriften

aus folgenden Fachgebieten:

Automobil + Motoren
Bauwesen + Immobilien
Business IT + Informatik
Elektrotechnik + Elektronik
Energie + Nachhaltigkeit
Finance + Banking
Management + Führung
Marketing + Vertrieb
Maschinenbau + Werkstoffe
Versicherung + Risiko

Jetzt Wissensvorsprung sichern!

Jetzt informieren

Springer Professional "Technik"

Online-Abonnement

Mit Springer Professional "Technik" erhalten Sie Zugriff auf:

über 67.000 Bücher
über 390 Zeitschriften

aus folgenden Fachgebieten:

Automobil + Motoren
Bauwesen + Immobilien
Business IT + Informatik
Elektrotechnik + Elektronik
Energie + Nachhaltigkeit
Maschinenbau + Werkstoffe

Jetzt Wissensvorsprung sichern!

Jetzt informieren

Springer Professional "Wirtschaft"

Online-Abonnement

Mit Springer Professional "Wirtschaft" erhalten Sie Zugriff auf:

über 67.000 Bücher
über 340 Zeitschriften

aus folgenden Fachgebieten:

Bauwesen + Immobilien
Business IT + Informatik
Finance + Banking
Management + Führung
Marketing + Vertrieb
Versicherung + Risiko

Jetzt Wissensvorsprung sichern!

Jetzt informieren

Titel: Performance Evaluation of PBDP Based Real-Time Speaker Identification System with Normal MFCC vs MFCC of LP Residual Features
verfasst von: Soma Khan
Joyanta Basu
Milton Samirakshma Bepari
Verlag: Springer Berlin Heidelberg
Buch: Perception and Machine Intelligence
Print ISBN: 978-3-642-27386-5

Electronic ISBN: 978-3-642-27387-2

Copyright-Jahr: 2012
DOI: https://doi.org/10.1007/978-3-642-27387-2_44

Springer Professional

Bitte loggen Sie sich ein, um Zugang zu Ihrer Lizenz zu erhalten.

Sie haben noch keine Lizenz? Dann Informieren Sie sich jetzt über unsere Produkte:

Springer Professional "Wirtschaft+Technik"

Springer Professional "Technik"

Springer Professional "Wirtschaft"

Premium Partner