Última actualización: 24 de septiembre de 2026
Un PDF guardado desde Word, una página web o un programa de contabilidad guarda sus palabras como texto: cada letra es un carácter que el equipo reconoce. Un PDF hecho con un escáner o con la cámara del teléfono guarda una imagen de la página. En pantalla no se distinguen; para el equipo, el segundo no contiene ni una sola palabra.
Algunos PDF son mixtos —páginas escritas a máquina con una página de firma escaneada o un certificado adjunto—, así que revisa la página que de verdad necesitas.
Con un PDF escaneado no puedes copiar un párrafo, buscar un nombre ni hacer que un lector de pantalla lo lea en voz alta. Al convertirlo a Word obtienes un documento con una imagen de cada página, porque no hay texto que poner en él. Y los escaneos pesan mucho, que es justo por lo que son los archivos que superan los límites de los portales.
El OCR —reconocimiento óptico de caracteres— mira la imagen de cada página y deduce qué letras hay en ella. OCR de PDF lo hace con un PDF escaneado, e imagen a texto con una foto o una captura de pantalla; las dos funcionan en tu navegador y leen quince idiomas, entre ellos árabe, chino, hindi y bengalí.
El reconocimiento es muy bueno con páginas impresas limpias y nunca es perfecto. Lee lo que ve, así que la calidad del escaneo decide la calidad del resultado:
Esta página en otros idiomas: English · العربية · বাংলা · Deutsch · فارسی · Français · עברית · हिन्दी · Bahasa Indonesia · Português · Русский · Türkçe · اردو · 中文