Qué es el OCR y cómo funciona
Actualizado el 23 de septiembre de 2026
El OCR, siglas de reconocimiento óptico de caracteres, es un software que lee las letras de una imagen y las convierte en texto que el ordenador puede buscar, copiar y editar. Es lo que permite buscar dentro de un contrato escaneado o sacar un párrafo de una página fotografiada. Esta guía explica el proceso, qué determina la precisión y dónde el OCR todavía falla.
El problema que resuelve el OCR
Para un ordenador, una página escaneada es una cuadrícula de puntos de colores. No sabe que un grupo de píxeles oscuros es la letra e, así que no hay nada que buscar, seleccionar ni copiar. Lo mismo ocurre con la foto de un recibo hecha con el móvil, una captura de pantalla o un PDF creado a partir de escaneos.
El OCR cubre esa brecha. Examina los píxeles, decide qué caracteres forman y devuelve texto real. Con el texto disponible, se vuelve posible todo lo que se espera de un documento digital: búsqueda, copia, traducción, indexación y conversión a Word o a texto sin formato.
Cómo funciona el OCR paso a paso
Los motores de OCR actuales siguen un proceso parecido. Los métodos exactos cambian según el motor, pero las etapas son reconocibles.
- Preparación: la imagen se convierte a blanco y negro o a escala de grises, se limpia de motas y a veces se endereza si la página está algo torcida.
- Análisis del diseño: el motor localiza bloques de texto, líneas y palabras, y deduce el orden de lectura.
- Reconocimiento: cada línea se compara con lo que el motor ha aprendido sobre las formas del idioma elegido. Tesseract, el motor de código abierto que usa nuestra herramienta de OCR, emplea una red neuronal en esta etapa.
- Comprobación lingüística: las palabras candidatas se contrastan con el conocimiento del idioma, lo que ayuda a decidir entre opciones de aspecto parecido.
- Salida: se devuelve el texto reconocido, como archivo de texto o como capa oculta alineada con la imagen original.
Qué determina la precisión
Lo que más importa es la imagen. Un escaneo nítido a 300 DPI, recto y con texto oscuro sobre fondo claro puede reconocerse muy bien. Las fotos borrosas, las sombras, la baja resolución, la tinta descolorida, los fondos de color y los dibujos recargados detrás del texto reducen la precisión.
El segundo factor es el idioma configurado: el motor necesita saber qué alfabeto esperar. Elegir inglés para un documento en francés, por ejemplo, produce letras acentuadas incorrectas o ausentes. El tercer factor es la tipografía: las fuentes impresas limpias son fáciles, las decorativas y la letra muy pequeña son más difíciles.
Errores típicos y su aspecto
El OCR pocas veces falla por completo; comete errores pequeños y previsibles. Los clásicos son el número 0 y la letra O, el número 1, la l minúscula y la I mayúscula, o el par rn leído como m. Las manchas del papel se convierten en signos de puntuación extraños.
Por eso los números, los códigos y los nombres merecen una segunda mirada, sobre todo en facturas, contratos y números de identificación. Cuando un solo dígito erróneo importa, compara el texto con la imagen original en vez de fiarte a ciegas.
Escritura a mano, tablas y alfabetos
El OCR rinde mejor con texto impreso. La escritura a mano no se reconoce de forma fiable, y la letra cursiva es mucho más difícil que las mayúsculas cuidadas. Las tablas, columnas y formularios también pueden alterar el orden de lectura, porque el motor ve bloques de texto y no la lógica de la tabla.
Los alfabetos también cuentan. El árabe se escribe de derecha a izquierda con letras unidas, así que es más difícil que el texto latino. En nuestra herramienta OCR PDF se reconocen el árabe y el ruso, pero el resultado se entrega como archivo .txt y no como capa de PDF buscable. Para los idiomas de escritura latina, la herramienta también puede generar un PDF buscable.
Qué produce el OCR
Hay dos salidas habituales. El texto sin formato son solo las palabras reconocidas en un archivo .txt, útil para reutilizar el contenido. El PDF buscable conserva la imagen original de la página y añade una capa de texto invisible: el documento se ve igual, pero se puede buscar y copiar.
OCR PDF puede generar uno, otro o ambos, en inglés, francés, español, árabe, alemán, italiano, portugués, neerlandés, turco y ruso. Funciona en tu navegador con Tesseract.js, sin subir tus documentos. El motor de OCR y los datos de idioma se descargan una vez desde una CDN pública la primera vez que lo usas, y el reconocimiento tarda unos segundos por página.
El OCR frente a herramientas parecidas
El OCR solo hace falta cuando la página no tiene texto. Si tu PDF se exportó desde Word u otro programa, ya contiene texto y PDF a texto o PDF a Word pueden leerlo directamente. Aplicar OCR a un archivo así solo añade trabajo, y por eso OCR PDF puede omitir las páginas que ya tienen texto.
Piensa en el OCR como el primer paso con los archivos escaneados. Reconoce las páginas y luego elige el formato que de verdad necesitas: un PDF buscable para archivar, un archivo de texto para reutilizar o un documento Word editable para hacer cambios.
Preguntas frecuentes
¿Qué significa OCR?
OCR significa reconocimiento óptico de caracteres. Es la tecnología que convierte imágenes de texto impreso o mecanografiado en texto legible por máquina, que se puede buscar, copiar y editar.
¿El OCR es exacto al 100 por ciento?
No. La precisión depende de la calidad del escaneo, del idioma configurado y de la fuente. Las páginas impresas nítidas y rectas se reconocen muy bien, mientras que las imágenes borrosas, la letra pequeña y la escritura a mano generan errores, así que revisa los números y nombres importantes.
¿Puede el OCR leer escritura a mano?
No de forma fiable. El texto impreso funciona bien, pero la escritura a mano varía tanto de una persona a otra que los resultados suelen ser malos, sobre todo con letra cursiva. Las mayúsculas de imprenta cuidadas funcionan mejor que la letra unida.
¿El OCR sube mi documento a un servidor?
No con OCR PDF. El reconocimiento se ejecuta en tu navegador mediante WebAssembly, así que los documentos nunca se suben. Solo el motor de OCR y los archivos de idioma se descargan una vez desde una CDN pública.
Herramientas mencionadas en esta guía
Más guías
- Cómo hacer buscable un PDF escaneadoConvierte un PDF escaneado en uno buscable con OCR: cómo saber si lo necesita, ajustes de idioma y DPI, qué esperar y cómo comprobar que el resultado funciona.
- Cómo escanear documentos a PDFConvierte papel en un PDF limpio con la cámara del móvil o un escáner: consejos de luz y encuadre, orden de páginas, filtro de documento, tamaño y texto buscable.