OCR PDF

Convierte un PDF escaneado en uno donde puedas buscar. Funciona en esta pestaña, sin cuenta, sin subir nada y sin límite de páginas.

Por qué un PDF escaneado necesita OCR

Un PDF escaneado es un montón de fotografías. Tus ojos lo leen sin problema, pero para el ordenador en esas páginas no hay más que puntos de color. Ctrl+F no encuentra nada. No puedes copiar una línea. Nada lo indexa, así que más adelante no volverá a aparecer en ninguna búsqueda.

El OCR —reconocimiento óptico de caracteres— es el paso que cambia eso. Mira las formas de cada página, decide qué letras son y escribe esas letras dentro del archivo como una capa invisible situada bajo la imagen. Después del OCR, el PDF se ve exactamente igual; la diferencia es que ahora hay texto debajo.

El momento que importa suele llegar meses después. Un contrato que escaneaste, una factura, un recibo, una página de un libro: recuerdas una frase y nada más. Un PDF con búsqueda te devuelve esa frase. Un montón de fotografías no.

Esta herramienta de OCR para PDF funciona por completo en tu navegador. El archivo no se sube, no hay cuenta y no hay tope de páginas. La página que nos gana en este término procesa tu archivo gratis y después te pide registrarte antes de devolvértelo.

Con subidaSu servidor?Esta herramientaTu dispositivoNada sale de tu dispositivo, no hay copia que borrar.
Otros conversores suben tu archivo a un servidor. Este lo dibuja donde ya está.

¿Qué es el OCR en un PDF?

El OCR en un PDF es reconocimiento de caracteres aplicado a las imágenes de página que contiene, con las palabras reconocidas escritas de vuelta en ese mismo archivo como una capa de texto invisible: el documento se ve igual, pero pasa a poder buscarse, seleccionarse y copiarse.

Dos tipos de PDF se ven idénticos en pantalla. Uno se exportó desde un procesador de textos y lleva texto real; el otro salió de un escáner o de la cámara de un móvil y lleva imágenes de texto. Solo el segundo necesita OCR.

Hay una forma rápida de distinguirlos sin ninguna herramienta: intenta seleccionar una línea con el ratón. Si un resaltado azul sigue a las palabras, el texto ya está ahí. Si se resalta toda la página como un bloque, o no pasa nada, tienes un PDF escaneado.

Esta herramienta hace esa comprobación por ti antes de ejecutar nada. Si el archivo ya tiene una capa de texto, lo dice y te sugiere extraer el texto en su lugar, porque el OCR sustituiría algo exacto por algo aproximado, y después no tendrías manera de notarlo, ya que la página se ve igual de todos modos.

El texto que produce el OCR va debajo de la imagen de la página, no encima. Por eso un PDF con búsqueda sigue pareciendo un escaneo: siempre estás mirando la imagen original. La capa invisible existe solo para tu cuadro de búsqueda, tu comando de copiar y lo que sea que indexe el archivo.

Vale la pena decir con claridad qué es esa capa. Es una suposición: muy buena sobre letra impresa limpia, mala sobre un recibo arrugado fotografiado torcido. La imagen que ves siempre es correcta. El texto de debajo puede no serlo.

Solo imagenInvoiceNo. 4471Total1,240.00+ capa de texto
El OCR no cambia el aspecto de la página. Añade una capa de texto debajo de la imagen, y es eso lo que permite buscar dentro del PDF.

Cómo hacer OCR a un PDF en cuatro pasos

Todo ocurre en esta pestaña del navegador. El archivo no sale de tu dispositivo, y nadie te pedirá crear una cuenta antes de dejarte descargar el resultado.

Lorem ipsumdolor sit ametconsecteturTiene textoSin OCRLorem ipsumAlgunas síSaltarlasSolo imagenEjecutar OCR
No todos los PDF necesitan OCR. Esta herramienta lo comprueba antes de ejecutar nada, porque releer un texto que ya es exacto solo lo empeora.
1

Suelta tu PDF escaneado

Arrastra el archivo sobre el recuadro de arriba, o haz clic para buscarlo. Los archivos de hasta 100 MB van bien. No se envía nada a ninguna parte: el archivo lo abre esta página, en tu navegador.

2

Lee el diagnóstico

La herramienta revisa cada página en busca de una capa de texto antes de hacer nada. Te dirá si tu PDF necesita OCR, si lo necesita solo en algunas páginas, o si no lo necesita. Si solo algunas páginas son escaneos, el resto se deja intacto por defecto.

3

Elige el idioma del documento

La precisión depende de esto más que de cualquier otra cosa que puedas ajustar. Elige el idioma en que está escrito el documento, no el idioma de esta interfaz. Los datos de idioma se descargan una sola vez —unos 5,2 MB para el inglés, 1,7 MB para el hindi— y luego quedan en caché. Seleccionar varios idiomas funciona, pero ralentiza cada página.

4

Ejecuta y comprueba el resultado

Las páginas se procesan de una en una, con una vista previa de la que se está leyendo, así que puedes parar pronto si soltaste el archivo equivocado. Al terminar, intenta seleccionar texto en la vista previa. Después descarga el PDF con búsqueda, o el texto plano si era lo único que querías.

¿Solo quieres las palabras? Si quieres el texto y no el PDF, y tu archivo ya tiene una capa de texto, hay un camino más rápido en el que no se adivina nada: extraer el texto directamente del PDF.

Qué hace esta herramienta de OCR para PDF

Añade una capa de texto y no cambia nada más. Tus páginas originales se conservan tal cual: mismas imágenes, misma resolución, mismos marcos de página. Las palabras reconocidas se dibujan encima con opacidad cero, así que se pueden seleccionar y buscar pero nunca se ven. Las páginas que ya tenían texto no se reescriben en absoluto.

Renderiza las páginas a 150 DPI, y es una decisión medida, no un valor por defecto. En un documento de prueba, la precisión a 100, 150, 200 y 300 DPI fue la misma dentro de medio punto porcentual, mientras que 300 DPI tardaba cuatro veces más. Por debajo de 100 DPI hay un precipicio: a 72 DPI la precisión cayó del 95,6 % al 79,3 %. Escanear a 600 DPI no hará que el OCR sea más preciso. Solo más lento.

Maneja más de 100 idiomas, incluidas escrituras que la mayoría de los conversores se saltan. Una de las herramientas de OCR en línea más conocidas indica 19 idiomas y ni uno es una escritura del sur de Asia. Aquí el hindi, el tamil y el bengalí están en la lista, y arriba, porque ahí es donde está de verdad la mayoría de quienes buscan esto.

Cuenta lo que no pudo hacer. Si una página vuelve sin texto —una hoja en blanco, una fotografía, algo escrito a mano—, se queda intacta en el archivo y se informa de ello. Nada se descarta en silencio.

Nunca te pide registrarte. Puedes procesar un documento de 400 páginas y luego otro. No hay límite diario, porque ningún servidor hace el trabajo y por tanto no hay nada que racionar.

Para qué usa la gente el OCR en PDF:

  • Hacer que contratos escaneados se puedan buscar antes de archivarlos
  • Encontrar una línea en un capítulo fotografiado página a página
  • Convertir una carpeta de facturas escaneadas en algo que se pueda rastrear
  • Sacar el texto de un fax o una fotocopia que llegó en PDF
  • Hacer que archivos escaneados antiguos se encuentren por búsqueda y no por memoria
  • Preparar escaneos para que un índice de búsqueda u otra herramienta pueda leerlos
  • Copiar un párrafo de un escaneo en lugar de volver a teclearlo

Funciona en cualquier dispositivo

No hay nada que instalar. El OCR se ejecuta en el navegador que ya tienes, así que la misma herramienta funciona en todas partes y tu archivo se queda en el dispositivo donde empezó.

§ 01

Windows

Chrome, Edge o Firefox. Nada que descargar y ninguna suscripción a Acrobat para hacer que un escaneo se pueda buscar.

§ 02

Mac

Safari o Chrome. Vista Previa puede mostrarte un PDF escaneado, pero no puede añadirle una capa de texto.

§ 03

iPhone y iPad

Funciona en Safari. Viene bien cuando el escaneo es una foto que acabas de hacer, aunque ese es justo el caso en el que más importa enderezar la página.

§ 04

Android

Funciona en Chrome. Los documentos largos tardan y mantienen ocupado el teléfono, así que enchúfalo antes.

§ 05

Chromebook

Encaja bien, porque todo se ejecuta localmente en el navegador en lugar de necesitar una aplicación instalada.

§ 06

Linux

Cualquier navegador moderno. Sin paquetes, sin línea de comandos y sin cola de espera.

Qué acierta el OCR y qué falla

Todas las herramientas de OCR cometen errores, y casi ninguna te cuenta cómo son esos errores. Aquí va un resultado real: una factura limpia, generada por ordenador, sin ruido, sin inclinación, con un 95,6 % de precisión por carácter en total. De doce palabras tomadas de ella, cinco se podían encontrar buscando.

En el archivoLeyó el OCRNorthwindNorthwindSubtotalSubtotal1741.501741.502089.802089. 80INV-2026INV2026ReplacementRepl acenentPayment isPaymentis5 de 12 palabras buscables
De una factura de prueba limpia, con un 95,6 % de precisión por carácter. El nombre de la empresa pasó; el total no, porque el OCR metió un espacio dentro del número.
En el documentoLeyó el OCRPor qué
NorthwindNorthwindProsa corriente en una tipografía proporcional es el caso fácil.
2089.802089. 80Apareció un espacio dentro del número, así que buscar el total no da nada.
INV-2026-04471INV2026-04471Se perdió un guion. Los números de referencia son especialmente frágiles.
ReplacementRepl acenentUna m leída como n, más un espacio que no estaba ahí.
Payment isPaymentisEl fallo contrario: se eliminó un espacio real.
1741.501741.50Misma tabla, misma tipografía que el total de arriba, y este salió bien. Los errores no son predecibles.

Lo que de verdad arruina un escaneo

No es la compresión ni la resolución. Un JPEG con calidad 60 quedó a una fracción de punto de un render sin pérdidas. Lo que hizo daño fue la inclinación: una página torcida dos grados no dio problemas, pero a siete grados la precisión bajó nueve puntos y medio y la confianza pasó de 91 a 74. Si vas a escanear algo, ponlo recto. No te molestes en subir los DPI.

¿PDF con búsqueda, texto plano o un archivo de Word?

Un PDF con búsqueda es lo que hace esta página: el escaneo que tenías, más una capa de texto invisible, y sigue siendo un PDF. El texto plano son las palabras sin la maquetación, útil cuando quieres pegarlas en otro sitio, y aquí se ofrece como segunda descarga. Un documento de Word editable es otro trabajo, que implica reconstruir la maquetación, y esta herramienta no lo hace. Si tu PDF ya tiene texto y solo quieres las palabras, sáltate el OCR y extráelas directamente.

Tu escaneo no sale de este navegador

El PDF que sueltas aquí lo abre esta página, lo lee tu propio procesador y lo vuelve a escribir tu propio navegador. No se sube, no se pone en cola en ningún servidor y no se guarda en ningún sitio durante un plazo de retención, porque en el trabajo no interviene ningún servidor.

Esto pesa más en el OCR que en la mayoría de conversiones. Los documentos que la gente necesita poder buscar son contratos, historiales médicos, extractos bancarios y documentos de identidad: precisamente los escaneos que existen porque el original merecía la pena guardarse. Todos los servicios grandes de OCR en línea los procesan en sus propias máquinas y los borran según un calendario, normalmente entre una y ocho horas después.

También significa que no hay nada que racionar. Los servicios que hacen el trabajo en su propio hardware tienen que limitar el uso gratuito, y por eso te topan en un par de tareas al día o diez páginas por archivo. Aquí el trabajo ocurre en tu dispositivo, así que no hay límite que imponer ni registro que recoger.

§ 01

No se sube nada

El archivo se lee localmente. No se crea ninguna copia suya en ningún servidor.

§ 02

Nunca una cuenta

No se te pide registrarte para descargar el resultado, que es el precio habitual del OCR gratuito en otros sitios.

§ 03

Sin límite de páginas ni de archivos

Procesa un escaneo de 400 páginas y luego otro. No hay cuota diaria.

§ 04

Solo datos de idioma

Lo único que se descarga son los datos de reconocimiento del idioma que elijas. Tu documento nunca forma parte de esa petición.

Preguntas frecuentes

¿Esta herramienta de OCR para PDF es realmente gratis y tiene límite de páginas?
Es gratis, sin límite de páginas y sin cuota diaria. El OCR se ejecuta en tu propio dispositivo en lugar de en un servidor, así que a nosotros no nos cuesta nada por archivo y no hay nada que racionar. Los documentos grandes solo están limitados por tu paciencia y tu batería.
¿Necesito registrarme para descargar el resultado?
No. Puedes soltar un archivo, ejecutar el OCR y descargar el PDF con búsqueda sin cuenta ni dirección de correo. Conviene comprobar esto en cualquier web de OCR antes de subir nada: es habitual que te pidan una cuenta solo en el paso de la descarga, cuando el trabajo ya está hecho.
¿Cómo sé si mi PDF necesita OCR?
Intenta seleccionar una línea de texto con el ratón. Si el resaltado sigue a las palabras, el archivo ya tiene una capa de texto y el OCR solo la empeoraría. Esta herramienta lo comprueba automáticamente cuando añades un archivo y te dice en cuál de los tres casos estás antes de ejecutar nada.
¿Qué precisión tiene el OCR?
La suficiente para ser útil y no la suficiente para fiarse a ciegas. En una factura de prueba limpia, generada por ordenador, la precisión por carácter fue del 95,6 %, pero solo 5 de 12 palabras tomadas de ella se podían encontrar buscando, porque un espacio acabó dentro de un número o desapareció un guion. La letra impresa nítida sale bien. Todo lo arrugado, desvaído o torcido sale peor.
¿Qué idiomas admite?
Más de 100, incluidos hindi, tamil, bengalí, tailandés, vietnamita e indonesio junto a los idiomas europeos habituales. Elige el idioma en que está escrito el documento, no el de esta página: influye en la precisión más que cualquier otro ajuste. Ten en cuenta que las escrituras que remodelan sus caracteres, como la devanagari, pueden perder alguna palabra al escribirse en la capa de texto del PDF aunque se hayan reconocido bien.
¿Lee la escritura a mano?
Da por hecho que no. Este motor está pensado para caracteres impresos, y la escritura a mano es otro problema para el que no fue entrenado. Una página manuscrita suele volver vacía o casi. Si pasa eso, la página se queda en tu archivo exactamente como estaba y se informa de ella en el resumen en vez de descartarla en silencio.
¿El PDF se verá distinto después?
No, y de eso se trata. Las imágenes de tus páginas se conservan tal cual y el texto reconocido se dibuja encima con opacidad cero. Sigues mirando el escaneo original; la capa de texto está solo para tu cuadro de búsqueda y tu comando de copiar.
¿Escanear con más DPI da mejores resultados de OCR?
Normalmente no. En las pruebas, la precisión a 100, 150, 200 y 300 DPI fue idéntica dentro de medio punto porcentual, mientras que 300 DPI tardaba cuatro veces más. Hay un suelo —a 72 DPI la precisión se hundió hasta el 79,3 %—, pero por encima de unos 150 DPI estás pagando tiempo a cambio de nada. Enderezar la página ayuda mucho más.
¿Cuánto tarda?
Alrededor de un segundo por página en un portátil normal con una página A4 estándar, así que un documento de 50 páginas ronda el minuto. Los móviles son más lentos. Seleccionar varios idiomas multiplica el trabajo, así que elige solo los que estén de verdad en el documento.
¿Se sube mi archivo a algún sitio?
No. El PDF se abre y se procesa dentro de esta pestaña y nunca se envía a un servidor. La única petición de red que hace la herramienta es la de los datos de reconocimiento del idioma que elegiste, que son el mismo archivo para todo el mundo y no contienen nada tuyo.
¿Qué diferencia hay con «PDF a texto»?
Esta página fabrica un PDF con búsqueda a partir de un escaneo adivinando los caracteres de las imágenes. «PDF a texto» saca el texto que ya está en el archivo, exacto y sin adivinar nada. Si tu PDF tiene una capa de texto, esa es la herramienta que quieres: es más rápida y no puede cometer el tipo de errores que comete el OCR.
¿Puedo obtener un documento de Word editable?
Con esta herramienta no. Convertir un escaneo en un archivo de Word implica reconstruir la maquetación —columnas, tablas, títulos— y ese es otro trabajo, con sus propios fallos. Lo que obtienes aquí es el PDF original hecho buscable, más una descarga en texto plano si quieres las palabras por separado.

Haz que tu PDF escaneado se pueda buscar

Gratis, ilimitado y funciona en esta pestaña. Sin subir nada, sin registro, y te avisa si tu archivo no necesita OCR.

Hacer OCR a un PDF