Estou criando um Dataset de Libras (Língua Brasileira de Sinais)
Bom dia,
Meu nome é Filipe Teixeira, sou Desenvolvedor Sênior e trabalho com Python desde a versão 2.6. Sou autodidata e atualmente estou estudando Machine Learning usando as plataformas Kaggle e Marimo para praticar.
Eu participo em trabalho voluntário junto à comunidade surda já por mais de 20 anos, já trabalhei como intérprete televisivo remunerado para a Câmara de Vereadores de Uruguaiana em 2010 e 2011, e recentemente comecei a namorar com uma surda. Então eu naturalmente desejo juntar IA com Língua de Sinais para facilitar a acessibilidade não apenas para minha namorada mas para todos os surdos.
Estou atualmente trabalhando em um projeto que envolve a captura de vídeos de sinalização em Libras e rotulagem de dados com as frases e palavras em português bem como timestamps.
No momento estou trabalhando em capturar vídeos de 100 palavras (apenas soletração) em velocidade de sinalização lenta e normal, com intervalo fixo entre elas, no mesmo vídeo. Usarei isso em um hardware RTX Blackwell 6000 no Marimo para treinar um modelo de IA para permitir traduzir soletração em texto em velocidade normal de soletração. Isso por que todos os apps ou projetos que vi atualmente trabalham com velocidade não condizente com a que os surdos usam, sendo muito aquém do potencial que a IA apresenta. Além disso a Libras envolve movimento e todos os projetos que eu vi deixam esse detalhe importantíssimo de lado, por isso meu projeto envolve palavras como um todo e não apenas pontos de captura em configurações de mão isoladas. (As letras H, Z, X, Y e W são exemplos disso).
A captura e rotulagem das letras é o primeiro passo, que preparará o terreno para os próximos sinais.
Caso tenha interesse no projeto, em contribuir para código opensource, deixo meu e-mail a seguir.