Clique para enviar ou solte um PDF escaneado aqui
Um PDF — lido com OCR no seu aparelho, nunca enviadoSobre OCR para PDF
Alguns PDFs não têm texto nenhum dentro. Um contrato escaneado, um recibo fotografado, um fax, um livro antigo passado no scanner de uma biblioteca — cada página é só uma imagem de texto. Você consegue ler, mas não consegue selecionar, copiar nem pesquisar.
O OCR (reconhecimento óptico de caracteres) resolve isso. Ele olha a imagem de cada página, reconhece o formato das letras e devolve texto de verdade, que você pode copiar, editar e pesquisar.
Esta ferramenta trabalha página por página e mostra o texto assim que cada página fica pronta, então você não precisa esperar o documento inteiro para começar.
Tudo acontece no seu aparelho
PDFs escaneados costumam ser os mais pessoais: um documento de identidade, uma carta do banco, um formulário médico, um contrato assinado. A maioria dos serviços de OCR on-line pede que você envie esses arquivos.
Este não. O motor de OCR (Tesseract, o motor de código aberto por trás de muitas ferramentas profissionais) roda dentro do seu navegador:
- Privado — o PDF nunca sai do seu aparelho
- Sem cadastro, sem limite de páginas, sem marca d'água
Na primeira vez, o motor e os dados do idioma são baixados — alguns megabytes. O navegador guarda tudo, então da próxima vez começa mais rápido.
Páginas de texto e páginas escaneadas no mesmo arquivo
Muitos PDFs são mistos. Páginas digitadas com uma página de assinatura escaneada no fim. Um escaneamento em que alguém já passou OCR. Um relatório com algumas páginas fotografadas no meio.
Por padrão, a ferramenta verifica cada página primeiro:
- Uma página que já tem texto de verdade é copiada como está — exata, na hora, sem erros de OCR
- Uma página que é só uma imagem é lida com OCR
No fim, você vê quantas páginas foram por cada caminho. Desmarque "Páginas que já têm texto de verdade" para forçar o OCR em todas as páginas — útil quando a camada de texto antiga está errada ou embaralhada.
Como ter o melhor resultado
O OCR é muito bom, mas está lendo uma imagem, então a imagem importa:
- Escolha o idioma certo. Ele muda quais letras e acentos o motor espera. Um texto em português lido como inglês perde o ç, o ã e os outros acentos.
- Páginas retas e nítidas são lidas melhor. Uma foto torta do celular ou um fax borrado dão mais erros.
- Texto impresso normal é lido bem. Letra de mão, letras muito pequenas e fontes decorativas são lidas mal.
- Tabelas saem como linhas de texto, não como tabela. Se for uma tabela, confira as colunas depois.
- Sempre leia o resultado antes de confiar nele. Cuidado com 1 / l / I, 0 / O e rn / m — as confusões clássicas do OCR.
Para que as pessoas usam
- Copiar um parágrafo de um contrato escaneado ou de uma carta
- Pegar o texto de um livro ou artigo antigo que só existe escaneado
- Deixar um recibo ou nota fiscal escaneado pesquisável nas suas anotações
- Tirar citações de artigos científicos escaneados e apostilas
- Passar formulários e registros para texto sem digitar tudo de novo
- Transformar um documento recebido por fax em algo que dá para editar
Bom saber
- Um PDF protegido por senha precisa ser desbloqueado primeiro — use Desbloquear PDF
- Documentos grandes levam tempo: cerca de 2–10 segundos por página no computador, mais no celular. Use Páginas para ler só a parte de que você precisa
- Parar mantém todas as páginas já lidas
- O resultado é texto simples. Para levar o texto ao Word, cole-o, ou use PDF para Word para PDFs que já têm texto
- Se o seu PDF tem texto de verdade em todas as páginas, PDF para texto é mais rápido e tem mais opções de layout
Perguntas frequentes
É grátis?
Sim. Sem cadastro, sem limite de páginas, sem marca d'água.
Meu PDF é enviado?
Não. As páginas são desenhadas e lidas dentro desta página, no seu próprio aparelho.
Quais idiomas ele lê?
Inglês, espanhol, francês, alemão, italiano, português, holandês, chinês (simplificado), japonês e coreano. Escolha um antes de começar.
Por que há erros no texto?
O OCR adivinha cada letra pelo formato. Um escaneamento borrado, torto ou de baixa resolução faz ele errar mais. Confira o resultado e corrija os poucos erros na caixa antes de copiar.
Ele pode deixar meu PDF pesquisável?
Ainda não — ele entrega o texto em um arquivo .txt separado. Seu PDF original não é alterado.
Como usar
- Clique em Clique para enviar, ou arraste seu PDF escaneado para a caixa
- Escolha o idioma do texto
- Digite um intervalo de páginas se precisar só de algumas — ou deixe vazio para todas
- Clique em Ler o texto e veja as páginas chegando
- Confira o texto e clique em Copiar ou Baixar .txt
Ferramentas relacionadas
- PDF para texto — para PDFs que já têm texto de verdade
- Imagem para texto — o mesmo OCR para uma foto ou uma captura de tela
- PDF para Word — transformar um PDF com texto em documento editável
- PDF para JPG — salvar as páginas escaneadas como imagens
- Comprimir PDF — diminuir um escaneamento pesado
- Desbloquear PDF — tirar a senha antes de ler