Video Datasets Integration for LIBRAS Automatic Translation with Deep Learning
Texto Integral no Repositório de Origem
Este trabalho acadêmico está catalogado com acesso aberto provido diretamente pelo veículo de publicação original (LA Referencia (Red Federada de Repositorios Institucionales de Publicaciones Científicas)).
Resumo
A comunicação por meio de sinais é uma forma importante de linguagem natural. A língua de sinais é uma maneira rica e diversificada de expressão humana, geralmente menos estudada, mas extremamente relevante para a comunidade surda. A principal questão abordada neste trabalho é como traduzir a Língua Brasileira de Sinais (LIBRAS) implementando métodos de Aprendizado Profundo (DL) com disponibilidade limitada de dados. Estudos anteriores tipicamente usam uma única base de dados, na maioria dos casos coletada pelos próprios autores. Neste trabalho é proposta uma abordagem diferenciada, de integração de diferentes fontes de dados, resultando em um Cross-Dataset, como uma alternativa mais adequada para avaliar a performance e capacidade de generalização dos modelos em um cenário mais realista. São explorados dois métodos para extrair as características espaciais. O primeiro se concentra em Redes Neurais Convolucionais (CNN) pré-treinadas, que exploram a capacidade das CNNs em capturar padrões visuais relevantes. O segundo se concentra na Estimação de Landmarks através de dados puramente visuais (RGB), que envolvem informações do esqueleto como pontos de referência da Pose, Mãos e Face. A fim de processar os dados sequenciais e realizar a classificação dos sinais isolados, uma rede Long Short-Term Memory (LSTM) é utilizada. Além disso, as conclusões obtidas não apenas apontam para a configuração de modelo mais eficaz, mas também exploram fatores de pré-processamento de vídeos, como amostragem de frames, redimensionamento ideal para estimação de Landmarks e aplicação de Data Augmentation. Uma das contribuições marcantes deste trabalho reside na coleta e compilação de um Cross-Dataset com dados oriundos de diversas instituições de ensino, cobrindo pelo menos três estados brasileiros. Ao reunir dados de diferentes fontes, este estudo fornece uma visão mais representativa da LIBRAS, contribuindo para uma compreensão mais p...
Resumo parcial : o texto recebido da fonte está incompleto. Consulte o texto integral no repositório de origem. Abrir a fonte
Como citar este trabalho
Direitos e uso
Os direitos deste trabalho pertencem aos autores e ao veículo de publicação original. O Libras.com.br cataloga e dá acesso ao documento, mas não define seus termos de uso: antes de reutilizar, copiar ou redistribuir o conteúdo, consulte a licença no repositório de origem.
Ver no repositório de origem