Saltar al contenido

OCR PDF: reconocer texto

Convierte un PDF escaneado en un documento con texto que se puede buscar, seleccionar y copiar. El reconocimiento se hace en tu propio dispositivo.

Tus archivos no salen de tu dispositivo Gratis, sin registro
Cargando herramienta…

Cómo se usa

  1. Elige tu PDF escaneado.
  2. Selecciona el idioma del documento.
  3. Pulsa Reconocer texto. Después descarga el PDF con texto o copia el texto directamente.

¿Qué es el OCR?

OCR significa reconocimiento óptico de caracteres. Cuando escaneas un papel o lo fotografías, el PDF resultante es solo una imagen: no puedes buscar palabras ni copiar el texto. El OCR “lee” la imagen y añade una capa de texto invisible encima, de modo que el documento se ve igual pero ahora puedes buscar y copiar.

Consejos para un buen resultado

  • Escanea a 300 ppp o haz la foto con buena luz y el papel bien plano.
  • Elige el idioma correcto: el modo español reconoce tildes, eñes y signos de apertura.
  • Los textos manuscritos y las tipografías muy decorativas se reconocen peor.

Después puedes pasar el texto a Word con PDF a Word.

Privacidad

A diferencia de otros servicios de OCR, aquí el reconocimiento se hace con Tesseract, un motor de código abierto que se ejecuta en tu navegador. Tu documento no se envía a ningún servidor, algo importante con contratos, historiales médicos o documentos de identidad.

Preguntas frecuentes

¿Cuánto tarda?
Entre 3 y 10 segundos por página, según la potencia de tu dispositivo. En un ordenador es más rápido que en el móvil.
¿El PDF resultante se ve igual?
Sí. Cada página conserva su aspecto y se le añade una capa de texto invisible para buscar y copiar.
¿Qué precisión tiene?
Con documentos impresos y bien escaneados suele superar el 95 %. Revisa siempre cifras y nombres importantes.
¿Funciona sin internet?
Una vez cargado el motor de reconocimiento, sí. La primera vez necesita descargar unos 7 MB.