OCR de PDF
Convierte un PDF escaneado en uno buscable y seleccionable. El OCR se ejecuta localmente en tu navegador, así que el archivo nunca sale de tu dispositivo.
No se sube nada
El motor de OCR se ejecuta como WebAssembly dentro de tu navegador. Tu escaneo nunca se envía a un servidor.
Comprueba lo que leyó
Cada palabra reconocida se resalta sobre la página, para que revises el resultado antes de descargarlo.
11 idiomas
Compatible con alfabeto latino, cirílico y escrituras CJK, incluidos chino, japonés, coreano y ruso.
Gratis, sin registro
Sin cuenta, sin marca de agua y sin límite de páginas. El único límite real es la memoria de tu dispositivo.
En resumen: El OCR de PDF lee el texto de una página escaneada y lo escribe de vuelta en el PDF como una capa de texto invisible. La página se ve exactamente igual, pero por fin puedes buscarla, seleccionarla y copiarla. Esta herramienta hace todo el trabajo dentro de tu navegador.
Por qué los PDF escaneados rompen tu flujo de trabajo
Un cliente te devuelve un contrato. Necesitas encontrar una cláusula. Pulsas Ctrl+F, escribes la palabra y el PDF te dice que no hay resultados, aunque la estás viendo en pantalla.
Ese es el momento en que la mayoría empieza a buscar OCR para PDF. El documento no está roto: simplemente nunca contuvo texto.
Un escaneo es una imagen, no un documento
Cuando un escáner o la cámara de un móvil captura una página, registra píxeles. Las letras que ves son formas, no caracteres. Para el lector de PDF, toda la página es una sola imagen plana.
Lo que pierdes sin reconocimiento de texto
Sin búsqueda. Sin copiar y pegar. Sin selección de texto para citar. Los lectores de pantalla no anuncian nada. Tu gestor documental indexa un archivo vacío. Todas esas funciones dependen de que la página contenga caracteres reales.
Dónde más duele
Contratos firmados, facturas en papel, recibos, historiales médicos, artículos académicos, archivos antiguos. Son justo los documentos que más necesitarás buscar después, y justo los que llegan escaneados.
¿Qué es el OCR de PDF?
El OCR de PDF es el proceso de leer el texto de la imagen de una página escaneada y guardarlo de nuevo en el PDF como una capa de texto real pero invisible: la página sigue viéndose idéntica, pero ahora puedes buscar, seleccionar y copiar sus palabras.
OCR significa reconocimiento óptico de caracteres. El motor observa las formas de la página, las compara con las letras de un idioma y devuelve caracteres junto a la posición exacta de cada palabra.
Cómo funciona la capa de texto invisible
Las palabras reconocidas se dibujan de nuevo sobre la página en el modo de representación de texto 3 del PDF, que significa «dibuja este texto pero no lo muestres». Cada palabra queda justo encima de su imagen en el escaneo.
Por eso un archivo con OCR bien hecho parece intacto y, aun así, se resalta correctamente al buscar. Estás seleccionando la capa invisible, no la imagen.
PDF buscable frente a extracción de texto plano
Cuándo quieres un PDF buscable
Necesitas conservar el aspecto original: firmas, sellos, membrete, maquetación. Todo lo que deba seguir siendo presentable o legalmente reconocible debe seguir siendo un PDF.
Cuándo solo quieres el texto
Vas a pegarlo en un correo, una hoja de cálculo o una nota. Entonces olvídate del PDF y llévate la exportación en texto plano. Esta herramienta te da ambas cosas en la misma pasada.
Lo que el OCR no puede arreglar
El OCR lee lo que hay. No puede recuperar texto que el escaneo desdibujó, y no corrige. Una foto torcida y de baja resolución producirá resultados torcidos y de baja calidad.
Cómo aplicar OCR a un PDF en 3 pasos
Todo el proceso ocurre en tu propia máquina. No hay colas, no hay subidas y no hay sala de espera.
- 1
Abre tu PDF escaneado
Arrastra el archivo al recuadro de arriba o elígelo desde tu dispositivo. Se carga directamente en la pestaña del navegador: no hay ningún paso de subida.
- 2
Elige el idioma del documento
Elige el idioma impreso en la página, no el de tu interfaz. El motor descarga ese paquete de idioma una vez y lo mantiene en caché.
- 3
Ejecuta el OCR y descarga
Míralo trabajar página a página, revisa las palabras resaltadas y llévate el PDF buscable o el texto plano. Ambos se generan localmente.
Consejo — El idioma importa más de lo que la gente espera. Pasar inglés sobre una página en alemán destrozará cada diéresis. Si el resultado parece un galimatías, la causa suele ser el idioma.
Nota — La primera pasada con un idioma nuevo descarga un paquete de menos de 3 MB. Después es instantáneo y funciona sin conexión.
Comprueba lo que el OCR leyó realmente
La mayoría de herramientas de OCR para PDF te entregan un archivo y te desean suerte. Solo descubres si funcionó tras descargarlo, abrir el PDF y buscar tú mismo.
Es un mal trato, porque la calidad de los escaneos varía muchísimo y el OCR falla en silencio. Una herramienta que devuelve un 60 % de acierto parece exactamente igual que una que devuelve un 99 %.
La capa de texto, hecha visible
Activa «Mostrar capa de texto» y cada palabra reconocida aparecerá enmarcada sobre la página. Lo que ves es exactamente lo que se escribió en el PDF.
Cómo detectar un mal escaneo antes de descargar
Las palabras de las que el motor duda se marcan en rojo. Pasa el ratón por cualquier recuadro para ver qué leyó y con cuánta confianza.
Una página con unos pocos recuadros rojos sueltos está bien. Una página casi entera en rojo significa que algo falla: normalmente el idioma equivocado, o un escaneo que hay que repetir a mayor resolución.
Qué puedes hacer con un PDF buscable
Una vez que existe la capa de texto, el documento empieza a comportarse como un documento de verdad allí donde lo uses.
Buscar dentro del documento
Ctrl+F funciona en cualquier lector de PDF y en cualquier dispositivo. Encontrar una cláusula en un contrato escaneado de 60 páginas deja de ser un desplazamiento manual.
Copiar y citar sin reescribir
Selecciona un párrafo y pégalo en un correo o un informe. Sin transcripción y sin erratas añadidas por el camino.
Hacer accesibles los escaneos
Los lectores de pantalla solo pueden leer una capa de texto. Aplicar OCR suele ser la mayor mejora de accesibilidad que puedes hacer a un archivo de escaneos.
Alimentar otras herramientas con texto limpio
Los índices de búsqueda, las apps de notas, los traductores y las hojas de cálculo necesitan caracteres, no píxeles. La exportación en texto plano encaja directamente.
Tu escaneo nunca sale de esta pestaña
Los documentos escaneados suelen ser los archivos más sensibles que alguien tiene: acuerdos firmados, pasaportes, papeleo fiscal, informes médicos. Subirlos a un servidor desconocido solo para poder buscarlos es un intercambio extraño.
Esta herramienta carga el motor de OCR en tu navegador como WebAssembly y lo ejecuta ahí. Los paquetes de idioma vienen de nuestro servidor, pero tu documento no va a ninguna parte. Puedes desconectarte de la red una vez cargada la página y aun así terminará el trabajo.
OCR de PDF en el navegador frente a herramientas que suben archivos
El procesamiento local es el valor por defecto correcto para documentos privados, pero no está libre de compromisos. Esta es la comparación honesta.
| Aspecto | Esta herramienta (en el navegador) | Herramientas OCR con subida |
|---|---|---|
| Adónde va tu archivo | Nunca sale de tu dispositivo | Se sube a un servidor remoto |
| Funciona sin conexión | Sí, tras la primera carga | No |
| Límite de tamaño | Lo marca la memoria de tu dispositivo | Lo marca el plan del servicio |
| Requiere cuenta | No | A menudo, con archivos grandes |
| Velocidad en PDF enormes | Más lenta: usa tu CPU | Más rápida: usa sus servidores |
| Precisión en escaneos difíciles | Buena con impresión limpia | A menudo mejor: motores comerciales |
Las dos últimas filas son reales. Un servicio comercial con un motor afinado superará a uno de código abierto ante un fax arrugado de 1998, y una granja de servidores siempre correrá más que un portátil con un archivo de 500 páginas. Si tu documento no es sensible y la precisión en un mal escaneo importa más que la privacidad, usa uno de esos.
Cómo conseguir la mejor precisión de OCR
La calidad del OCR se decide sobre todo antes de pulsar el botón. Estas cuatro cosas explican casi toda la diferencia.
- 1
Escanea a 300 PPP o más
Es el factor más importante. A 150 PPP los bordes de los caracteres empiezan a fundirse; a 72 PPP, la mayoría de motores adivina. 300 PPP es el objetivo estándar para el reconocimiento de texto.
- 2
Endereza y limpia la página primero
Una página girada apenas dos grados reduce la precisión de forma medible. Activa el enderezado para escaneos torcidos y la limpieza de fondo para los grises o moteados.
- 3
Un idioma por pasada
Mezclar paquetes de idioma diluye la precisión. Si un documento está mayormente en inglés con algún nombre francés, pásalo como inglés.
- 4
Revisa la capa de texto y repite
Mira las palabras resaltadas antes de descargar. Si una página está llena de recuadros rojos, cambia el idioma o los ajustes de escaneo y vuelve a intentarlo: no te cuesta nada.
Suite completa de herramientas PDF
Descubre nuestra colección completa de herramientas PDF diseñadas para manejar todas tus necesidades de documentos
PNG a PDF
Combina imágenes PNG en un único PDF listo para imprimir
JPG a PDF
Convierte imágenes JPG a formato PDF
Fusionar PDF
Combina múltiples archivos PDF en uno
Comprimir PDF
Reduce el tamaño del archivo PDF eficientemente
PDF a PNG
Convierte páginas PDF a imágenes PNG
PDF a JPG
Convierte páginas PDF a imágenes JPG
PDF a texto
Extrae contenido de texto de archivos PDF
Dividir PDF
Divide PDF en páginas separadas
Editar PDF
Edita y anota documentos PDF
Organizar PDF
Organiza y reordena páginas PDF
Rotar PDF
Rota las páginas de un PDF y guárdalas de forma permanente
Números de página
Agrega números de página a un PDF con vista previa en tiempo real
Marca de agua PDF
Añade una marca de agua de texto a un PDF con vista previa en tiempo real
HEIC a JPG
Convierte fotos HEIC de iPhone a JPG
Eliminar páginas PDF
Quita las páginas que te sobran y descarga un PDF limpio
Extraer páginas de PDF
Guarda las páginas seleccionadas como un nuevo PDF o en archivos separados
Firmar PDF
Dibuja, escribe o sube una firma y colócala en cualquier página
Redimensionar PDF
Cambia el tamaño de página a A4, Carta (Letter) o medidas personalizadas
Recortar PDF
Elimina márgenes, selecciona arrastrando o recorta automáticamente el espacio en blanco
Aplanar PDF
Haz que los formularios sean de solo lectura: mantén el texto con búsqueda o bloquéalo como imagen
Metadatos PDF
Consulta, edita o elimina el autor, el título, las fechas y otros metadatos
PDF a escala de grises
Convierte a escala de grises o blanco y negro para ahorrar tinta de color
Extraer imágenes de un PDF
Saca las fotos, los logotipos y los gráficos incrustados como PNG o JPG
WebP a PDF
Convierte imágenes WebP a un PDF y une varias en un solo archivo
Proteger PDF
Añade una contraseña de apertura a tu PDF, todo en tu navegador
Desbloquear PDF
Quita una contraseña conocida o las restricciones de un PDF, en tu navegador
HEIC a PDF
Convierte fotos HEIC de iPhone a PDF
AVIF a PDF
Convierte imágenes AVIF a PDF
TIFF a PDF
Convierte imágenes y escaneos TIFF a PDF
BMP a PDF
Convierte imágenes BMP a PDF
OCR PDF
Haz que un PDF escaneado se pueda buscar, todo en tu navegador
Censurar PDF
Elimina definitivamente el texto sensible de un PDF, en tu navegador
Comprimir imagen
Reduce JPEG, PNG y WebP por lotes, todo en tu navegador
Redimensionar imagen
Cambia las dimensiones en lote, con preajustes, en tu navegador
Preguntas frecuentes
Todo lo que la gente pregunta antes de aplicar OCR a un escaneo.
¿Cómo se aplica OCR a un PDF gratis?
Abre el archivo arriba, elige el idioma del documento y pulsa Ejecutar OCR. Todo el proceso ocurre en esta pestaña del navegador y no cuesta nada. Obtienes un PDF buscable y un archivo de texto plano, sin cuenta y sin límite de páginas.
¿Esta herramienta de OCR es realmente gratis? ¿Cuál es el límite?
Es gratis, sin tope de páginas y sin marca de agua. No imponemos cuotas porque no asumimos el coste: el trabajo lo hace tu dispositivo. El límite práctico es la memoria; en un móvil antiguo un escaneo enorme puede agotarla, y entonces conviene procesar por rangos de páginas.
¿Mis archivos se suben a un servidor?
No. Tu PDF nunca sale del navegador. El motor de OCR es WebAssembly ejecutándose en local. Lo único que se descarga de nosotros es el motor y el paquete de idioma. Puedes comprobarlo desconectándote de la red una vez cargada la página: el OCR sigue funcionando.
¿Qué precisión tiene el OCR?
Muy buena con texto impreso limpio, más floja con manuscritos y malos escaneos. Un escaneo a 300 PPP de texto impreso corriente suele reconocerse por encima del noventa por ciento. La escritura a mano, el papel de fax descolorido, las tablas densas y las fotos de baja resolución empeoran rápido. Usa la vista de capa de texto para juzgar tu propio documento en lugar de fiarte de una media.
¿Puedo convertir un PDF escaneado a Word con OCR?
No directamente: esta herramienta genera un PDF buscable y texto plano, no un .docx. Para la mayoría de casos, la exportación en texto plano es justo lo que necesitas y puedes pegarla en un documento. Si solo quieres el texto suelto, nuestra herramienta de PDF a texto cubre ese caso.
¿Qué idiomas admite el OCR de PDF?
Once, que cubren alfabeto latino, cirílico y escrituras CJK. Inglés, chino simplificado y tradicional, español, portugués, alemán, francés, italiano, japonés, coreano y ruso. Las escrituras no latinas obtienen una capa de texto completa, así que los escaneos en chino o ruso son realmente buscables, no solo en parte.
¿Por qué la primera pasada es más lenta que la segunda?
La primera descarga el motor de OCR y el paquete de idioma. Después ambos quedan en la caché de tu navegador, así que las siguientes pasadas empiezan de inmediato y funcionan sin conexión. Cambiar a un idioma nuevo descarga ese paquete una vez.
¿Qué hago después de aplicar OCR a un PDF?
Normalmente comprimirlo o extraer el texto. La capa de texto solo añade unos kilobytes por página, pero el escaneo de debajo suele ser grande. Comprimir después mantiene la búsqueda y reduce el tamaño.
Herramientas relacionadas
Otras cosas que quizá quieras hacer con el mismo documento.
- PDF a texto — extrae el texto de un PDF que ya tiene capa de texto.
- Comprimir PDF — reduce el escaneo tras el OCR sin perder la capa de texto.
- PDF a PNG — exporta páginas como imágenes si quieres limpiarlas antes de reescanear.
- PDF a escala de grises — quita el color de un escaneo ruidoso, lo que suele mejorar el reconocimiento.
- Unir PDF — combina varias páginas escaneadas en un documento antes de aplicar OCR.
- Censurar PDF — elimina el texto sensible cuando el escaneo ya se puede buscar.
Haz buscables tus escaneos
Aplica OCR a un PDF aquí mismo, en tu navegador. Sin subidas, sin cuenta y sin límite de páginas.
Abrir la herramienta de OCR