OCR PDF
Convierte un PDF escaneado en uno donde puedas buscar. Funciona en esta pestaña, sin cuenta, sin subir nada y sin límite de páginas.
Suelta aquí un PDF escaneado, o haz clic para elegirlo
Hasta 100 MB · no se sube nada
- 100 % en tu navegador
- Sin subir archivos
- Descarga sin registro
- Sin límite de páginas
Por qué un PDF escaneado necesita OCR
Un PDF escaneado es un montón de fotografías. Tus ojos lo leen sin problema, pero para el ordenador en esas páginas no hay más que puntos de color. Ctrl+F no encuentra nada. No puedes copiar una línea. Nada lo indexa, así que más adelante no volverá a aparecer en ninguna búsqueda.
El OCR —reconocimiento óptico de caracteres— es el paso que cambia eso. Mira las formas de cada página, decide qué letras son y escribe esas letras dentro del archivo como una capa invisible situada bajo la imagen. Después del OCR, el PDF se ve exactamente igual; la diferencia es que ahora hay texto debajo.
El momento que importa suele llegar meses después. Un contrato que escaneaste, una factura, un recibo, una página de un libro: recuerdas una frase y nada más. Un PDF con búsqueda te devuelve esa frase. Un montón de fotografías no.
Esta herramienta de OCR para PDF funciona por completo en tu navegador. El archivo no se sube, no hay cuenta y no hay tope de páginas. La página que nos gana en este término procesa tu archivo gratis y después te pide registrarte antes de devolvértelo.
¿Qué es el OCR en un PDF?
El OCR en un PDF es reconocimiento de caracteres aplicado a las imágenes de página que contiene, con las palabras reconocidas escritas de vuelta en ese mismo archivo como una capa de texto invisible: el documento se ve igual, pero pasa a poder buscarse, seleccionarse y copiarse.
Dos tipos de PDF se ven idénticos en pantalla. Uno se exportó desde un procesador de textos y lleva texto real; el otro salió de un escáner o de la cámara de un móvil y lleva imágenes de texto. Solo el segundo necesita OCR.
Hay una forma rápida de distinguirlos sin ninguna herramienta: intenta seleccionar una línea con el ratón. Si un resaltado azul sigue a las palabras, el texto ya está ahí. Si se resalta toda la página como un bloque, o no pasa nada, tienes un PDF escaneado.
Esta herramienta hace esa comprobación por ti antes de ejecutar nada. Si el archivo ya tiene una capa de texto, lo dice y te sugiere extraer el texto en su lugar, porque el OCR sustituiría algo exacto por algo aproximado, y después no tendrías manera de notarlo, ya que la página se ve igual de todos modos.
El texto que produce el OCR va debajo de la imagen de la página, no encima. Por eso un PDF con búsqueda sigue pareciendo un escaneo: siempre estás mirando la imagen original. La capa invisible existe solo para tu cuadro de búsqueda, tu comando de copiar y lo que sea que indexe el archivo.
Vale la pena decir con claridad qué es esa capa. Es una suposición: muy buena sobre letra impresa limpia, mala sobre un recibo arrugado fotografiado torcido. La imagen que ves siempre es correcta. El texto de debajo puede no serlo.
Cómo hacer OCR a un PDF en cuatro pasos
Todo ocurre en esta pestaña del navegador. El archivo no sale de tu dispositivo, y nadie te pedirá crear una cuenta antes de dejarte descargar el resultado.
Suelta tu PDF escaneado
Arrastra el archivo sobre el recuadro de arriba, o haz clic para buscarlo. Los archivos de hasta 100 MB van bien. No se envía nada a ninguna parte: el archivo lo abre esta página, en tu navegador.
Lee el diagnóstico
La herramienta revisa cada página en busca de una capa de texto antes de hacer nada. Te dirá si tu PDF necesita OCR, si lo necesita solo en algunas páginas, o si no lo necesita. Si solo algunas páginas son escaneos, el resto se deja intacto por defecto.
Elige el idioma del documento
La precisión depende de esto más que de cualquier otra cosa que puedas ajustar. Elige el idioma en que está escrito el documento, no el idioma de esta interfaz. Los datos de idioma se descargan una sola vez —unos 5,2 MB para el inglés, 1,7 MB para el hindi— y luego quedan en caché. Seleccionar varios idiomas funciona, pero ralentiza cada página.
Ejecuta y comprueba el resultado
Las páginas se procesan de una en una, con una vista previa de la que se está leyendo, así que puedes parar pronto si soltaste el archivo equivocado. Al terminar, intenta seleccionar texto en la vista previa. Después descarga el PDF con búsqueda, o el texto plano si era lo único que querías.
¿Solo quieres las palabras? Si quieres el texto y no el PDF, y tu archivo ya tiene una capa de texto, hay un camino más rápido en el que no se adivina nada: extraer el texto directamente del PDF.
Qué hace esta herramienta de OCR para PDF
Añade una capa de texto y no cambia nada más. Tus páginas originales se conservan tal cual: mismas imágenes, misma resolución, mismos marcos de página. Las palabras reconocidas se dibujan encima con opacidad cero, así que se pueden seleccionar y buscar pero nunca se ven. Las páginas que ya tenían texto no se reescriben en absoluto.
Renderiza las páginas a 150 DPI, y es una decisión medida, no un valor por defecto. En un documento de prueba, la precisión a 100, 150, 200 y 300 DPI fue la misma dentro de medio punto porcentual, mientras que 300 DPI tardaba cuatro veces más. Por debajo de 100 DPI hay un precipicio: a 72 DPI la precisión cayó del 95,6 % al 79,3 %. Escanear a 600 DPI no hará que el OCR sea más preciso. Solo más lento.
Maneja más de 100 idiomas, incluidas escrituras que la mayoría de los conversores se saltan. Una de las herramientas de OCR en línea más conocidas indica 19 idiomas y ni uno es una escritura del sur de Asia. Aquí el hindi, el tamil y el bengalí están en la lista, y arriba, porque ahí es donde está de verdad la mayoría de quienes buscan esto.
Cuenta lo que no pudo hacer. Si una página vuelve sin texto —una hoja en blanco, una fotografía, algo escrito a mano—, se queda intacta en el archivo y se informa de ello. Nada se descarta en silencio.
Nunca te pide registrarte. Puedes procesar un documento de 400 páginas y luego otro. No hay límite diario, porque ningún servidor hace el trabajo y por tanto no hay nada que racionar.
Para qué usa la gente el OCR en PDF:
- Hacer que contratos escaneados se puedan buscar antes de archivarlos
- Encontrar una línea en un capítulo fotografiado página a página
- Convertir una carpeta de facturas escaneadas en algo que se pueda rastrear
- Sacar el texto de un fax o una fotocopia que llegó en PDF
- Hacer que archivos escaneados antiguos se encuentren por búsqueda y no por memoria
- Preparar escaneos para que un índice de búsqueda u otra herramienta pueda leerlos
- Copiar un párrafo de un escaneo en lugar de volver a teclearlo
Funciona en cualquier dispositivo
No hay nada que instalar. El OCR se ejecuta en el navegador que ya tienes, así que la misma herramienta funciona en todas partes y tu archivo se queda en el dispositivo donde empezó.
Windows
Chrome, Edge o Firefox. Nada que descargar y ninguna suscripción a Acrobat para hacer que un escaneo se pueda buscar.
Mac
Safari o Chrome. Vista Previa puede mostrarte un PDF escaneado, pero no puede añadirle una capa de texto.
iPhone y iPad
Funciona en Safari. Viene bien cuando el escaneo es una foto que acabas de hacer, aunque ese es justo el caso en el que más importa enderezar la página.
Android
Funciona en Chrome. Los documentos largos tardan y mantienen ocupado el teléfono, así que enchúfalo antes.
Chromebook
Encaja bien, porque todo se ejecuta localmente en el navegador en lugar de necesitar una aplicación instalada.
Linux
Cualquier navegador moderno. Sin paquetes, sin línea de comandos y sin cola de espera.
Qué acierta el OCR y qué falla
Todas las herramientas de OCR cometen errores, y casi ninguna te cuenta cómo son esos errores. Aquí va un resultado real: una factura limpia, generada por ordenador, sin ruido, sin inclinación, con un 95,6 % de precisión por carácter en total. De doce palabras tomadas de ella, cinco se podían encontrar buscando.
| En el documento | Leyó el OCR | Por qué |
|---|---|---|
| Northwind | Northwind | Prosa corriente en una tipografía proporcional es el caso fácil. |
| 2089.80 | 2089. 80 | Apareció un espacio dentro del número, así que buscar el total no da nada. |
| INV-2026-04471 | INV2026-04471 | Se perdió un guion. Los números de referencia son especialmente frágiles. |
| Replacement | Repl acenent | Una m leída como n, más un espacio que no estaba ahí. |
| Payment is | Paymentis | El fallo contrario: se eliminó un espacio real. |
| 1741.50 | 1741.50 | Misma tabla, misma tipografía que el total de arriba, y este salió bien. Los errores no son predecibles. |
Lo que de verdad arruina un escaneo
No es la compresión ni la resolución. Un JPEG con calidad 60 quedó a una fracción de punto de un render sin pérdidas. Lo que hizo daño fue la inclinación: una página torcida dos grados no dio problemas, pero a siete grados la precisión bajó nueve puntos y medio y la confianza pasó de 91 a 74. Si vas a escanear algo, ponlo recto. No te molestes en subir los DPI.
¿PDF con búsqueda, texto plano o un archivo de Word?
Un PDF con búsqueda es lo que hace esta página: el escaneo que tenías, más una capa de texto invisible, y sigue siendo un PDF. El texto plano son las palabras sin la maquetación, útil cuando quieres pegarlas en otro sitio, y aquí se ofrece como segunda descarga. Un documento de Word editable es otro trabajo, que implica reconstruir la maquetación, y esta herramienta no lo hace. Si tu PDF ya tiene texto y solo quieres las palabras, sáltate el OCR y extráelas directamente.
Tu escaneo no sale de este navegador
El PDF que sueltas aquí lo abre esta página, lo lee tu propio procesador y lo vuelve a escribir tu propio navegador. No se sube, no se pone en cola en ningún servidor y no se guarda en ningún sitio durante un plazo de retención, porque en el trabajo no interviene ningún servidor.
Esto pesa más en el OCR que en la mayoría de conversiones. Los documentos que la gente necesita poder buscar son contratos, historiales médicos, extractos bancarios y documentos de identidad: precisamente los escaneos que existen porque el original merecía la pena guardarse. Todos los servicios grandes de OCR en línea los procesan en sus propias máquinas y los borran según un calendario, normalmente entre una y ocho horas después.
También significa que no hay nada que racionar. Los servicios que hacen el trabajo en su propio hardware tienen que limitar el uso gratuito, y por eso te topan en un par de tareas al día o diez páginas por archivo. Aquí el trabajo ocurre en tu dispositivo, así que no hay límite que imponer ni registro que recoger.
No se sube nada
El archivo se lee localmente. No se crea ninguna copia suya en ningún servidor.
Nunca una cuenta
No se te pide registrarte para descargar el resultado, que es el precio habitual del OCR gratuito en otros sitios.
Sin límite de páginas ni de archivos
Procesa un escaneo de 400 páginas y luego otro. No hay cuota diaria.
Solo datos de idioma
Lo único que se descarga son los datos de reconocimiento del idioma que elijas. Tu documento nunca forma parte de esa petición.
Preguntas frecuentes
¿Esta herramienta de OCR para PDF es realmente gratis y tiene límite de páginas?⌄
¿Necesito registrarme para descargar el resultado?⌄
¿Cómo sé si mi PDF necesita OCR?⌄
¿Qué precisión tiene el OCR?⌄
¿Qué idiomas admite?⌄
¿Lee la escritura a mano?⌄
¿El PDF se verá distinto después?⌄
¿Escanear con más DPI da mejores resultados de OCR?⌄
¿Cuánto tarda?⌄
¿Se sube mi archivo a algún sitio?⌄
¿Qué diferencia hay con «PDF a texto»?⌄
¿Puedo obtener un documento de Word editable?⌄
Haz que tu PDF escaneado se pueda buscar
Gratis, ilimitado y funciona en esta pestaña. Sin subir nada, sin registro, y te avisa si tu archivo no necesita OCR.
Hacer OCR a un PDFHerramientas de conversión relacionadas
Descubre más herramientas de nuestra suite completa de conversión de archivos
PDF a texto
Extrae el texto, cópialo o guárdalo en .txt. Reconstruye el orden de lectura, recoge los campos de formulario rellenados y te avisa cuando una página es un escaneo.
PDF escaneado a PNG
PNG privado y sin pérdida a partir de documentos escaneados
Comprimir PDF
Reduce el tamaño de tus PDF hasta un 80%