OCR de um PDF digitalizado

Leia as palavras de um PDF que é, na verdade, uma imagem de uma página. Recebe o texto e uma cópia pesquisável do original com uma camada de texto invisível sobre a digitalização — fica exatamente igual e o Ctrl-F encontra coisas. Seus arquivos nunca são enviados — tudo acontece no seu dispositivo.

  1. Your PDF

    Drop a scanned PDF here

    PDF

    Your files are never uploaded — everything runs on your device.

  2. Before you start

  3. Text

Como fazer OCR a um PDF

  1. Abra o seu PDF digitalizado

    Arraste-o, ou clique para o escolher. O documento é lido aqui, no navegador — nada é carregado, o que importa mais do que o habitual no tipo de papelada que as pessoas digitalizam.

  2. Veja quanto vai custar

    Antes de correr o que quer que seja, vê o número de páginas, a transferência única do modelo e um intervalo de tempo. As páginas que já têm texto são ignoradas e, se todas tiverem, a ferramenta di-lo em vez de correr.

  3. Leia e transfira

    Leve o texto simples, ou o PDF pesquisável. Também comunica as páginas que vieram vazias, em vez de deixar buracos em silêncio.

O que você pode fazer

Junte e divida

Combine vários PDFs em um só ou extraia apenas as páginas de que você precisa e faça o download delas como um arquivo separado.

Imagens → PDF

Arraste e solte imagens JPG ou PNG para transformá-las em páginas de PDF que você pode organizar junto com seus documentos e baixar como um único PDF.

PDF → imagens

Exporte páginas no sentido inverso também: converta cada página (ou uma seleção) em PNG ou JPG e baixe tudo junto em um arquivo ZIP.

Reordene arrastando

Arraste uma página pela alça para movê-la. Funciona com mouse e toque, para que você possa reorganizar seus documentos também no celular.

Gire e auto-oriente

Gire qualquer página 90° por vez ou deixe o Auto-rotate detectar digitalizações de lado e de cabeça para baixo para alinhá-las para você.

Visualize qualquer página

Clique em uma página para abrir uma visualização nítida em tamanho real e navegar pelo documento antes de baixar.

Exclua e extraia

Remova páginas que você não precisa ou extraia um intervalo selecionando as páginas e baixando apenas a seleção.

Comprima

Reduza um PDF: um novo salvamento sem perdas que mantém o texto selecionável ou uma compressão de imagem mais forte para digitalizações e arquivos pesados.

Privado e gratuito

Sem contas, sem limites de páginas, sem marcas d'água. Seus arquivos nunca são enviados — cada operação é executada localmente no seu navegador.

Perguntas frequentes

Que motor de OCR é este?
Tesseract, compilado para WebAssembly e a correr no seu navegador — o mesmo motor por trás da nossa ferramenta de imagem para texto. O modelo tem cerca de 5 MB, é transferido uma vez e depois fica em cache, por isso o segundo documento não custa nada extra.
O que é um PDF pesquisável?
A sua digitalização, inalterada, com as palavras reconhecidas escritas por cima como texto invisível. As páginas ficam exatamente como estavam — não as re-renderizamos, por isso os dados de imagem, a compressão e os marcadores sobrevivem — mas o Ctrl-F, o copiar e colar e tudo o que extrai texto encontram agora as palavras.
O meu PDF já tem texto. Devo usar isto?
Não, e a ferramenta vai dizer-lho. Se uma página já tem texto, esse texto é o que o documento realmente diz; o reconhecimento só pode adivinhar as mesmas palavras pela forma e vai errar algumas. O texto existente é usado tal como está, e um documento totalmente pesquisável segue para o conversor de Markdown.
Qual é a qualidade do resultado?
Depende quase inteiramente da digitalização. Texto preto limpo e direito sobre branco a 300 ppp corre muito bem; uma fotografia de telemóvel de um recibo amarrotado não. Não há aqui uma etapa de limpeza de imagem — sem endireitar nem corrigir contraste — por isso lê o que lhe der. A confiança média e as páginas vazias são comunicadas para que julgue em vez de adivinhar.
Suporta outras línguas além do inglês?
Ainda não. O modelo aqui incluído é o inglês. Um documento noutra língua produzirá algo, e esse algo estará errado de formas difíceis de detetar — trate o inglês como o limite e não como uma preferência.
Meus PDFs são enviados para um servidor?
Não. Todas as operações são executadas inteiramente no seu navegador, no seu próprio dispositivo. Seus arquivos nunca são enviados para lugar nenhum e nada fica armazenado após fechar a aba.
É realmente gratuito? Existem limites?
Sim, é totalmente gratuito e não exige criação de conta. Não há limites de páginas ou de quantidade de arquivos, nem marcas d'água — como o processamento é feito no seu dispositivo, não há nada para limitarmos.