BestPDFInTheWorld
Guia · OCR

Como fazer OCR a um PDF

Fazer OCR a um PDF é ler o texto que está dentro das imagens de um documento digitalizado e devolvê-lo como texto: o mesmo PDF com uma camada de texto invisível por cima, que fica pesquisável, seleccionável e copiável, ou o texto em bruto num ficheiro .txt. No BestPDFInTheWorld faz-se em três passos: arrastar o PDF digitalizado (ou uma imagem) para a janela, escolher a língua do documento, português, inglês ou espanhol, e descarregar o resultado. Todo o reconhecimento corre no seu browser, o que é raro numa ferramenta de OCR: a digitalização nunca sai do computador. O resultado é tão bom quanto o digitalizado: uma página direita e bem iluminada lê-se quase toda bem, uma fotografia torta ou escura dá texto com erros, e a escrita à mão não é reconhecida. Esta ferramenta faz parte da subscrição Premium, 1,99 EUR por mês, que tira os limites de todas as ferramentas e acrescenta o OCR. O Assinar PDF abre no plano gratuito, com uma assinatura por dia.

Verificado a 2026-08-12

Resumo
  • Três passos, sem instalar nada: escolher o ficheiro, escolher a língua do documento e descarregar o resultado.
  • Recebe um PDF pesquisável, as páginas originais com uma camada de texto invisível por cima, ou o texto em bruto num ficheiro .txt.
  • Sem uploads: o motor de reconhecimento é descarregado para o seu browser e trabalha na sua máquina; o digitalizado nunca sai do computador.
  • Reconhece português, inglês e espanhol. O resultado é tão bom quanto o digitalizado, e a escrita à mão não é lida.
  • O OCR faz parte da subscrição Premium, 1,99 EUR por mês, que tira os limites de todas as ferramentas.

Como fazer OCR a um PDF passo a passo

Um PDF digitalizado é uma pilha de fotografias: não se pesquisa, não se copia, não se selecciona uma linha. O OCR lê o que está nessas imagens e devolve o texto. Na ferramenta OCR do BestPDFInTheWorld são três passos, sem instalar nada:

  1. Escolha o ficheiro. Arraste o PDF digitalizado para a janela da ferramenta, ou uma imagem de um documento (PNG, JPEG ou WebP).
  2. Escolha a língua do documento. Português, inglês ou espanhol. É a língua do documento, não a da interface, e escolher mal degrada muito o resultado.
  3. Descarregue o resultado. Recebe um PDF pesquisável com as páginas originais, ou o texto em bruto num ficheiro .txt.

Todo o trabalho acontece no seu computador, do início ao fim: o documento digitalizado nunca sai do browser.

O que o OCR devolve

Por omissão, recebe um PDF pesquisável: o documento original, com as páginas tal como estavam, mais uma camada de texto invisível por cima, que o leitor não desenha. Não se vê nada de novo na página, mas a pesquisa do leitor de PDF encontra as palavras, o rato selecciona linhas e o copiar e colar funciona. É também assim que os motores de busca e os arquivos internos passam a encontrar o documento.

Se preferir só o texto, a ferramenta devolve-o em bruto num ficheiro .txt. Uma nota honesta: o reconhecimento lê linhas de texto, não a estrutura da página, num documento em duas colunas, ou com uma tabela densa, a ordem sai muitas vezes trocada no .txt. No PDF pesquisável isso não se nota, porque cada palavra fica no sítio dela.

Quando usar o OCR

  • Use-o quando não consegue seleccionar nada. Se no seu leitor de PDF não é possível marcar uma palavra, o documento é feito de imagens e o OCR é a ferramenta certa.
  • Não o use se o PDF já tem texto. Se consegue seleccionar uma palavra, o texto já lá está: use antes a ferramenta Extrair texto, que é imediata e não inventa nada.
  • Não lê escrita à mão. Uma assinatura, uma nota manuscrita na margem ou um formulário preenchido à mão não são reconhecidos, o que sair daí é ruído.
  • Só lê as três línguas para que tem modelo. Português, inglês e espanhol. Um documento em francês ou em alemão é lido com o modelo que escolher, e o resultado será mau. Um documento com duas línguas misturadas lê-se pela que escolher, e a outra sai pior.
  • O resultado é tão bom quanto o digitalizado. Uma página direita, com boa luz e resolução decente lê-se quase toda bem; uma fotografia tirada de lado, com sombra a meio, ou digitalizada em baixa resolução, dá texto com erros, e por vezes muitos. Se puder repetir a digitalização, repita: rende mais do que qualquer opção desta ferramenta.

Dicas para tirar o melhor do OCR

  • Escolha bem a língua do documento. É ela que decide o modelo de reconhecimento; a língua da interface não interessa para o resultado.
  • A primeira utilização demora mais. Na primeira vez, o browser descarrega o motor de reconhecimento e o modelo da língua que escolheu, que juntos são vários megabytes. Fica guardado no browser: das vezes seguintes arranca logo. Se mudar de língua, descarrega o modelo dessa língua, e só desse.
  • Conte com alguns segundos por página. Depende da máquina e da qualidade escolhida. A ferramenta mostra o progresso página a página, para saber que está a andar. Documentos de muitas páginas demoram mesmo: não é engano, é o preço de reconhecer letra por letra.
  • Comece pela qualidade Rápida. Serve para ver depressa se vale a pena tratar o documento. A Normal serve a maior parte dos casos; a Alta ajuda em letra pequena ou em digitalizações fracas, e demora bastante mais.
  • A camada de texto é uma aproximação. As palavras ficam sobre as palavras da imagem, mas a caixa de selecção pode ficar ligeiramente desalinhada, sobretudo em letra muito pequena ou em páginas tortas. Isso não afecta a pesquisa: afecta o rectângulo que o leitor realça quando encontra a palavra.
  • Digitalizou com o telemóvel? As páginas que saem da ferramenta Digitalizar para PDF são imagens, tal como saíram da câmara: passe o resultado pelo OCR para o tornar pesquisável.

Esta ferramenta faz parte da subscrição Premium, 1,99 EUR por mês, que tira os limites de todas as ferramentas e acrescenta o OCR. O Assinar PDF abre no plano gratuito, com uma assinatura por dia.

As três qualidades da ferramenta OCR.
QualidadeQuando usar
RápidaPara ver depressa se vale a pena tratar o documento.
NormalServe a maior parte dos casos: texto de tamanho normal em digitalizações razoáveis.
AltaAjuda em letra pequena ou em digitalizações fracas; demora bastante mais.
Dúvidas

Perguntas sobre OCR de PDF.

O OCR é grátis?

Não. Esta ferramenta faz parte da subscrição Premium, 1,99 EUR por mês, que tira os limites de todas as ferramentas e acrescenta o OCR. O Assinar PDF abre no plano gratuito, com uma assinatura por dia.

Os meus ficheiros ficam guardados nos vossos servidores?

Não. Como nada é enviado, nada fica guardado fora do seu browser. O motor de reconhecimento é que vem ter com os seus ficheiros, e não o contrário.

Posso usar uma fotografia em vez de um PDF?

Pode. A ferramenta aceita PNG, JPEG e WebP, além de PDF. Uma fotografia direita e bem iluminada dá resultado; uma fotografia tirada de lado dá pouco.

O meu PDF já tem texto. Preciso de OCR?

Não. Se consegue seleccionar uma palavra no seu leitor de PDF, o texto já lá está: use antes o Extrair texto, que é imediato e não inventa nada. O OCR serve para os documentos onde não consegue seleccionar nada.

Que qualidade devo escolher?

A Normal serve a maior parte dos casos. A Alta ajuda em letra pequena ou em digitalizações fracas, e demora bastante mais. A Rápida serve para ver depressa se vale a pena tratar o documento.

Porque é que a primeira utilização demora mais?

Porque na primeira vez o browser descarrega o motor de reconhecimento e o modelo da língua que escolheu, que juntos são vários megabytes. Fica guardado no browser: das vezes seguintes arranca logo. Se mudar de língua, descarrega o modelo dessa língua, e só desse.

O OCR lê escrita à mão?

Não. Reconhece letra impressa: uma assinatura, uma nota manuscrita na margem ou um formulário preenchido à mão não são reconhecidos, e o que sair daí é ruído.

Um digitalizado
que não se pesquisa?

Abra a ferramenta e experimente. Sem instalar nada, sem enviar nada para lado nenhum.

Abrir o OCR