PDF escaneado ou PDF de texto? Por que não dá para copiar o texto — e como resolver

Atualizado em 24 de setembro de 2026

Dois tipos de PDF que parecem iguais

Um PDF salvo do Word, de um site ou de um programa de contabilidade guarda as palavras como texto: cada letra é um caractere que o computador reconhece. Um PDF feito por um scanner ou pela câmera do celular guarda uma imagem da página. Na tela, não dá para distinguir um do outro; para o computador, o segundo não tem palavra nenhuma.

Como descobrir em dez segundos

Alguns PDFs são mistos — páginas digitadas com uma página de assinatura escaneada ou um certificado anexado —, então confira a página de que você realmente precisa.

  • Tente selecionar uma única palavra. Se em vez disso um quadro azul cobrir a página inteira, é uma imagem.
  • Pesquise uma palavra que você está vendo (Ctrl+F, ou ⌘F no Mac). Num escaneado, nada é encontrado.
  • Aumente bastante o zoom. O texto continua nítido em qualquer zoom; o escaneado fica borrado ou quadriculado.
  • Olhe o tamanho. Dez páginas de texto costumam ter algumas centenas de kilobytes; dez páginas escaneadas muitas vezes têm vários megabytes.

Por que isso importa

Num PDF escaneado você não consegue copiar um parágrafo, procurar um nome nem usar um leitor de tela para ouvir o conteúdo. Converter para Word gera um documento com uma imagem de cada página, porque não existe texto para colocar nele. E escaneados são pesados, e é por isso que são eles que estouram os limites de envio.

Tirando as palavras de lá: reconhecimento de texto (OCR)

O OCR — reconhecimento óptico de caracteres — olha a imagem de cada página e descobre quais letras estão ali. O OCR de PDF faz isso com um PDF escaneado, e o imagem para texto faz com uma foto ou captura de tela; os dois rodam no seu navegador e leem quinze idiomas, entre eles árabe, chinês, híndi e bengali.

O reconhecimento é muito bom em páginas impressas e limpas, mas nunca é perfeito. Ele lê o que vê, então a qualidade do escaneamento decide a qualidade do resultado:

  • Escaneie a 300 DPI se a letra for pequena; 200 DPI bastam para texto de tamanho normal.
  • Deixe a página plana e reta, com luz uniforme e sem sombra da mão ou do celular.
  • Escolha o idioma certo. Uma página lida no idioma errado sai com as letras mais parecidas do idioma escolhido.
  • Letra de mão é mal reconhecida por qualquer motor de OCR; conte com digitar você mesmo.
  • Confira sempre nomes, números e datas com os próprios olhos. Um 0 lido como O ou um 1 lido como l é o erro mais comum, e num formulário oficial é onde ele pesa mais.

Qual ferramenta para qual PDF

Mais guias

Esta página em outros idiomas: English · العربية · বাংলা · Deutsch · Español · فارسی · Français · עברית · हिन्दी · Bahasa Indonesia · Русский · Türkçe · اردو · 中文