Tradução de Voz em Texto
Desenvolvimento MobileDescrição do Projeto
Especificação — Módulo de Transcrição de Voz para Preenchimento de FormuláriosIdioma: Português brasileiro Modelo de interação: Fala livre — a IA interpreta a intenção e extrai os dados estruturados Objetivo: Preencher campos de um formulário a partir do áudio do usuário, sem necessidade de falar em formato rígido O frontend captura o áudio do microfone do usuário usando a Web Audio API ou MediaRecorder API. A gravação inicia quando o usuário acionar o botão de voz (pressionar e segurar, ou toggle) e encerra quando ele soltar ou acionar novamente.O áudio deve ser capturado no formato audio/webm com codec opus ou audio/mp4, pois são os formatos com melhor suporte cross-browser e compatíveis com a API de transcrição. A taxa de amostragem recomendada é 16kHz mono, que é suficiente para fala humana e reduz o tamanho do arquivo enviado.Antes de enviar, aplicar uma validação mínima: rejeitar gravações com menos de 0,5 segundos (clique acidental) e exibir feedback visual ao usuário durante todo o tempo de gravação (ícone pulsando, timer, waveform simples).