Gast
#2046616
Guten Tag, kann mir jmd. den merkmalstechnischen Unterschied zwischen einer Sprecher und einer Spracherkennung erklären? Klar, dass bei einer Sprechererkennung nicht der Inhalt des gesprochenen, sondern die personenbezogenen Merkmale von Bedeutung sind und bei der Spracherkennung nicht der Erzeuger des Sprachsignals sondern der Inhalt ermittelt werden soll. Bei der Sprecher sowie bei der Sprachrkennung ist die Vorverarbeitung gleich. Die Merkmalsextraktion mittels beispielsweise den MFCC's wird auch bei beiden Varianten angewandt. Ebenfalls die Klassifikation, beispielsweise mit der Vektorquantisierung und dem Kmeans Algorihmus. Aber wo trennen sich die beiden Verfahren. Ich habe zuerst gedacht, dass man je nach Verfahren die unteren Cepstralkoeffizienten nimmt oder die oberen. Aber auch da werden bei beiden Verfahren jeweils die ersten 12 (evtl. 1. und 2. Ableitung noch) Koeffizienten genommen. Oder wird bezogen auf das Quelle Filter Modell bei dem Cepstrum jeweils die Filtereigenschaft subtrahiert oder die Quelleigenschaft? Vielleicht kann mir da jmd. Licht ins dunkeln bringen, dafür wäre ich sehr dankbar. Lieben Gruß und Dank audiouser