Saltar al contenido
PDFlora

Cómo hacer buscable un PDF escaneado

Actualizado el 23 de septiembre de 2026

Un PDF escaneado parece texto, pero en realidad es un montón de imágenes de páginas: Ctrl+F no encuentra nada y no puedes copiar una frase. El OCR lee esas imágenes y añade encima una capa de texto invisible, con lo que las mismas páginas se pueden buscar sin cambiar su aspecto. Esta guía explica cómo comprobar si lo necesitas, cómo ejecutarlo en el navegador y cómo mejorar el resultado.

Primero, comprueba si el PDF necesita OCR

Abre el archivo, intenta seleccionar una palabra con el ratón y pulsa Ctrl+F para buscar una palabra visible en la página. Si se resalta, el PDF ya tiene capa de texto y no necesita OCR. Si no se puede seleccionar ni encontrar nada, las páginas son imágenes.

Información del PDF ofrece una segunda opinión: un documento formado por escaneos normalmente no lista fuentes e indica imágenes incrustadas, mientras que un PDF de texto lista sus fuentes. Algunos archivos mezclan ambos, con páginas de texto y páginas escaneadas, por eso la herramienta de OCR incluye una opción para omitir las páginas que ya tienen texto.

Qué es un PDF buscable

Un PDF buscable conserva la imagen original de la página y coloca detrás o encima una capa invisible de texto reconocido, alineada con las palabras. Sigues viendo el escaneo, con sus sellos, firmas y anotaciones a mano, pero la búsqueda, la selección y la copia funcionan porque existe esa capa.

El texto solo es tan bueno como el reconocimiento. Un carácter mal leído no se ve en pantalla, pero hace que esa palabra no se pueda encontrar, y por eso la calidad del original importa tanto.

Prepara el escaneo para reconocer mejor

La mayoría de los errores de OCR se deben a la imagen, no al programa. Unas correcciones antes de empezar ahorran mucho tiempo después.

  • Escanea a 300 DPI. Por debajo de unos 200 DPI, los caracteres pequeños pierden el detalle que necesita el OCR.
  • Mantén las páginas rectas. Una página torcida produce líneas inclinadas, más difíciles de leer.
  • Cuida el contraste: texto oscuro sobre fondo claro, sin sombras del lomo del libro ni dedos en el encuadre.
  • Evita la compresión excesiva y las fotos de documentos de resolución muy baja.
  • Si aún estás capturando las páginas, Escanear a PDF monta el archivo con tus fotos en el orden correcto.

Ejecuta OCR PDF en tu navegador

OCR PDF usa Tesseract.js: las páginas se dibujan, se reconocen y se reconstruyen en tu dispositivo, sin subir los documentos. La primera vez, el motor de OCR y los datos del idioma se descargan una sola vez desde una CDN pública, unos pocos MB en total.

  • Abre OCR PDF y añade tu PDF escaneado (también acepta imágenes JPG y PNG).
  • Elige el idioma del documento. Puedes seleccionar varios si una página mezcla idiomas, por ejemplo inglés y francés.
  • Selecciona la resolución, 200 o 300 DPI. Usa 300 para letra pequeña y 200 para terminar antes.
  • Mantén la opción de omitir las páginas que ya tienen texto si el archivo es mixto.
  • Elige la salida: PDF buscable, archivo de texto sin formato o ambos, y empieza.

Límites de idioma y escritura

Los idiomas disponibles son inglés, francés, español, árabe, alemán, italiano, portugués, neerlandés, turco y ruso. Equivocarse de idioma es la forma más rápida de obtener un mal resultado, porque el motor compara las formas con ese alfabeto.

La capa de texto invisible del PDF buscable admite idiomas de escritura latina. Para árabe y ruso, la herramienta entrega el texto reconocido como descarga .txt, y la capa de PDF buscable no está disponible para esas escrituras. La escritura a mano no se reconoce de forma fiable en ningún idioma.

Velocidad, tamaño y qué esperar

El OCR es lento comparado con la mayoría de las tareas con PDF. Cuenta con varios segundos por página en un portátil y más en un móvil, así que un libro de 200 páginas puede tardar. Mantén la pestaña abierta mientras trabaja y prueba primero unas pocas páginas para validar los ajustes antes de procesar todo el documento.

Como se conserva la imagen de la página, el resultado no pesa menos. Si es demasiado grande para enviarlo, Comprimir PDF puede reducirlo después; conviene comprobar que la búsqueda sigue funcionando tras la compresión.

Comprueba el resultado

Abre el PDF nuevo, pulsa Ctrl+F y busca tres palabras: una de la primera página, otra del medio y otra del final. Prueba también una palabra con tilde o un número, porque son los caracteres que más confunde el OCR, como 0 y O o 1 y l.

Si solo necesitas las palabras y no el diseño, PDF a texto extrae la capa de texto a un archivo .txt. Para un documento que hay que editar, ejecuta primero el OCR y luego PDF a Word, porque la conversión a Word no tiene nada que leer en una página escaneada.

Preguntas frecuentes

¿Cómo sé si mi PDF es un escaneo?

Intenta seleccionar una palabra con el ratón o buscar con Ctrl+F. Si no se puede seleccionar ni encontrar nada, las páginas son imágenes y necesitan OCR. Información del PDF también muestra si el archivo lista fuentes e imágenes incrustadas.

¿El OCR cambia el aspecto de las páginas?

No. En un PDF buscable la imagen original de la página se queda tal cual y el texto reconocido se añade como capa invisible. Las páginas se ven igual, pero la búsqueda y la copia ya funcionan.

¿Por qué el resultado del OCR tiene tantos errores?

Casi siempre la causa es el escaneo: poca resolución, páginas torcidas, texto pálido o idioma equivocado. Vuelve a escanear a 300 DPI con buen contraste, elige el idioma correcto y repite. La escritura a mano no se reconoce de forma fiable.

¿Se suben mis documentos para hacer el OCR?

No. OCR PDF se ejecuta en tu navegador y los documentos nunca se suben. Solo el motor de OCR y los archivos de idioma se descargan una vez desde una CDN pública la primera vez que usas la herramienta.

Herramientas mencionadas en esta guía

Más guías