Repository logo
 
Loading...
Profile Picture
Person

Teixeira, Felipe

Search Results

Now showing 1 - 2 of 2
  • Utilização de ferramentas de machine learning no diagnóstico de patologias da laringe
    Publication . Teixeira, Felipe; Teixeira, João Paulo
    Este trabalho está relacionado com o estudo e utilização de um conjunto de ferramentas de machine learning, nomeadamente árvores de decisão, support vector machines (SVM’s), Deep-learning - Deep Neural Networks, com o prepósito de fazer a classificação entre fala patológica e fala normal, e identificar a patologia com estas ferramentas. As patologias utilizadas neste estudo são a laringite crónica, disfonia e paralisia das cordas vocais. Utilizou-se a base de dados Alemã Saarbrucken Voice Database (SVD), que se encontra disponível online de forma gratuita pelo Instituto de Fonética da Universidade de Saarland. Nesta base de dados é possível encontrar sinais de voz, entre saudáveis e patológicos de mais de 2000 sujeitos. Foram utilizados três grupos de parâmetros, o grupo I (a), contêm parâmetros como Jitter relativo, Shimmer relativo e Harmonic to Noise Ratio (HNR), determinados em segmentos de fala estacionária, onde se atingiu 80.7% de exatidão para distinguir saudáveis e patológicos com SVM. O grupo I (b), contêm os parâmetros do grupo I(a), Noise to Harmonic Ratio (NHR) e Autocorrelação determinados em segmentos de fala estacionária, onde se atingiu 79.2% de exatidão para distinguir saudáveis e patológicos com SVM. O grupo II é baseado em Mel Frequency Cepstral Coefficientes (MFCC’s), determinados nos segmentos de fala estacionários, onde se atingiu 83.3% de exatidão para distinguir saudáveis e laringite com SVM. O grupo III é formado por coeficientes MFCC’s extraídos de fala contínua onde se atingiu 71% de exatidão para distinguir saudáveis e patológicos com Redes Neuronais. Realizou-se uma análise estatística referente aos parâmetros do grupo I (b), com o propósito de identificar características únicas em determinados parâmetros, que permitissem diferenciar as patologias. No decorrer deste trabalho, embora não fosse objetivo inicial, deu-se início a elaboração de um “software” protótipo para fazer gravação de voz, extração de parâmetros e classificação da patologia.
  • Transfer learning with audioSet to voice pathologies identification in continuous speech
    Publication . Guedes, Victor; Teixeira, Felipe; Oliveira, Alessa Anjos de; Fernandes, Joana Filipa Teixeira; Silva, Letícia; Candido Junior, Arnaldo; Teixeira, João Paulo
    The classification of pathological diseases with the implementation of concepts of Deep Learning has been increasing considerably in recent times. Among the works developed there are good results for the classification in sustained speech with vowels, but few related works for the classification in continuous speech. This work uses the German Saarbrücken Voice Database with the phrase “Guten Morgen, wie geht es Ihnen?” to classify four classes: dysphonia, laryngitis, paralysis of vocal cords and healthy voices. Transfer learning concepts were used with the AudioSet database. Two models were developed based on Long-Short-Term-Memory and Convolutional Network for classification of extracted embeddings and comparison of the best results, using cross-validation. The final results allowed to obtaining 40% of f1-score for the four classes, 66% f1-score for Dysphonia x Healthy, 67% for Laryngitis x healthy and 80% for Paralysis x Healthy.