MP3 para texto, sem enviar o arquivo

O MP3 é para onde vai o áudio falado do mundo: episódios de podcast, entrevistas gravadas, acervos de palestras, arquivos antigos de ditafone. Esta página transforma esses MP3s em texto pesquisável e editável — bem aqui na aba do seu navegador, sem enviar nada para lugar nenhum.

Um episódio de podcast de uma hora levaria um tempo só para ser enviado na maioria das conexões. Aqui não há etapa de envio: o arquivo é lido do disco e transcrito na hora, com a transcrição aparecendo à medida que é processada. Seus arquivos nunca são enviados — tudo acontece no seu dispositivo.

Verificando o que este navegador suporta…

Como converter um MP3 em texto

  1. Adicione seu MP3

    Arraste o arquivo para a ferramenta acima. Episódios longos não são problema — a duração só custa tempo da sua máquina, não dinheiro.

  2. Deixe transcrever em blocos

    A gravação é processada em janelas de 30 segundos, assim o início de uma entrevista longa já pode ser lido enquanto o restante ainda está sendo processado.

  3. Ajuste e exporte

    Corrija nomes e jargões com um clique, pesquise dentro da transcrição e depois exporte em TXT para anotações, SRT/VTT para legendas ou JSON para processamento adicional.

Feito para áudios longos

Ideal para a duração de podcasts

Sem cobrança por minuto, transcrever uma temporada inteira é apenas uma questão de deixar a ferramenta rodar. O progresso e a estimativa de tempo mantêm você informado sobre arquivos mais longos.

Áudio comprimido sem problemas

A compressão do MP3 não é um obstáculo — o decodificador que já vem no seu navegador lida com taxas de bits desde gravações de voz até masters de estúdio.

Entrevistas permanecem confidenciais

Entrevistas não publicadas e materiais sob embargo nunca saem da sua máquina. Não há cópia em servidor com que se preocupar, porque nenhum servidor está envolvido.

Dúvidas sobre a transcrição de MP3

Qual pode ser a duração do MP3?
Não há um limite imposto. A duração prática depende da memória do seu dispositivo e da sua paciência — episódios de uma hora são comuns, e a transcrição aparece à medida que é processada para que você possa começar a ler antes.
Uma taxa de bits baixa prejudica a precisão?
Gravações muito comprimidas ou com ruído são transcritas com menos precisão do que gravações limpas — isso é verdade para qualquer sistema de transcrição. A fala continua inteligível para o modelo em taxas de bits muito inferiores à qualidade típica de um podcast.
Posso obter marcações de tempo para cada trecho?
Sim. Cada segmento contém horários de início e fim, visíveis na visualização da transcrição e preservados nas exportações em SRT, VTT e JSON.
Qual motor realiza a transcrição?
Ela é alimentada pelo modelo de código aberto Whisper da OpenAI, executado no seu navegador por meio de WebGPU ou WebAssembly. O nosso motor que o envolve também é de código aberto.
Por que não há barra de progresso de envio?
Porque nada é enviado. O arquivo é lido diretamente do seu disco para a memória do navegador. O único download é o próprio modelo, feito uma única vez na sua primeira visita.