WAV para texto para gravações sérias
WAV é o formato de quem se importa com o áudio: sessões de estúdio, gravações de campo, takes de locução, digitalizações de tribunais e arquivos. Esses arquivos são grandes — uma única hora de áudio não compactado pode passar de 600 MB —, o que torna a ideia de “enviar para o nosso servidor” um fluxo de trabalho péssimo.
Esta ferramenta ignora o envio completamente. O WAV é decodificado no seu navegador e transcrito no seu próprio hardware, assim um arquivo enorme começa a ser processado imediatamente em vez de arrastar sua conexão. Seus arquivos nunca são enviados — tudo acontece no seu dispositivo.
Verificando o que este navegador suporta…
Como transcrever um arquivo WAV
-
Solte o WAV
Qualquer taxa de amostragem ou quantidade de canais funciona — a ferramenta faz o downmix e a reamostragem automaticamente antes da transcrição.
-
O processamento começa instantaneamente
Sem espera para enviar, mesmo para arquivos muito grandes. A transcrição aparece progressivamente, mostrando o progresso em relação à duração da gravação.
-
Refine e exporte
Corrija vocabulário técnico diretamente na tela, depois exporte TXT para documentos, SRT/VTT para legendas ou JSON com a marcação de tempo precisa dos segmentos.
Construído para arquivos pesados
Sem gargalo de envio
Um arquivo de sessão de 600 MB levaria uma eternidade para ser enviado. Lê-lo localmente leva segundos — o único trabalho real é a transcrição em si.
Qualquer taxa de amostragem de entrada
CDs de 44.1 kHz, áudios de vídeo de 48 kHz, masters de 96 kHz, arquivos telefônicos de 8 kHz: tudo é reamostrado corretamente nos bastidores.
As masters continuam suas
Gravações não lançadas e sessões de clientes nunca tocam um servidor de terceiros. O que você gravou permanece exatamente onde você colocou.
Perguntas sobre transcrição de WAV
- Existe um limite de tamanho de arquivo?
- Nenhum limite rígido é imposto. Arquivos muito grandes são limitados pela memória do seu dispositivo; o áudio é processado em blocos para manter o uso estável durante a transcrição.
- Taxas de amostragem altas melhoram a transcrição?
- Na verdade não — os modelos de fala escutam a 16 kHz e seu arquivo é reamostrado automaticamente para isso. Taxas de amostragem altas não atrapalham, mas também não aumentam a precisão.
- Estéreo, mono, multicanal?
- Tudo certo. Os canais são combinados para mono antes da transcrição, que é o que o reconhecimento de fala espera.
- Qual modelo faz o reconhecimento?
- O modelo Whisper de código aberto da OpenAI, executado localmente no seu navegador pelo nosso mecanismo de código aberto. Nada do seu áudio é enviado para executá-lo.
- Posso transcrever vários takes em sequência?
- Sim — solte o próximo arquivo assim que a transcrição anterior for concluída (ou cancele no meio do caminho). O modelo continua carregado, então os arquivos seguintes pulam o download e começam mais rápido.