Atualizado em 24 de setembro de 2026
Um PDF salvo do Word, de um site ou de um programa de contabilidade guarda as palavras como texto: cada letra é um caractere que o computador reconhece. Um PDF feito por um scanner ou pela câmera do celular guarda uma imagem da página. Na tela, não dá para distinguir um do outro; para o computador, o segundo não tem palavra nenhuma.
Alguns PDFs são mistos — páginas digitadas com uma página de assinatura escaneada ou um certificado anexado —, então confira a página de que você realmente precisa.
Num PDF escaneado você não consegue copiar um parágrafo, procurar um nome nem usar um leitor de tela para ouvir o conteúdo. Converter para Word gera um documento com uma imagem de cada página, porque não existe texto para colocar nele. E escaneados são pesados, e é por isso que são eles que estouram os limites de envio.
O OCR — reconhecimento óptico de caracteres — olha a imagem de cada página e descobre quais letras estão ali. O OCR de PDF faz isso com um PDF escaneado, e o imagem para texto faz com uma foto ou captura de tela; os dois rodam no seu navegador e leem quinze idiomas, entre eles árabe, chinês, híndi e bengali.
O reconhecimento é muito bom em páginas impressas e limpas, mas nunca é perfeito. Ele lê o que vê, então a qualidade do escaneamento decide a qualidade do resultado:
Esta página em outros idiomas: English · العربية · বাংলা · Deutsch · Español · فارسی · Français · עברית · हिन्दी · Bahasa Indonesia · Русский · Türkçe · اردو · 中文