Funciona en tu navegador

Imagen a texto

Extrae el texto de una foto, una captura o un escaneo, directamente en tu navegador. No se sube nada.

Procesado local0 subidas~1.2 s promedioSin cuenta

No se sube nada

El motor de OCR se ejecuta dentro de esta página. Tu DNI, factura o contrato nunca sale del dispositivo.

Las imágenes pequeñas se amplían

Las capturas por debajo del tamaño útil se escalan a la altura de letra que el motor necesita, en lugar de devolvértelas.

Varios idiomas a la vez

Lee una captura con alfabetos mezclados en una sola pasada, en vez de elegir un idioma y perder la mitad.

Hasta 20 imágenes

Procesa un lote entero y descarga todos los resultados juntos. Sin cuenta y sin límite diario.

En resumen: Para extraer texto de imágenes, suelta una foto o captura, elige el idioma o los idiomas que contiene y recibe el texto. Todo ocurre en tu navegador, así que no se sube nada. Si la imagen es un escaneo o se tomó en ángulo, deja activadas las opciones de limpieza: importan más que la herramienta que elijas.

Por qué la misma foto da resultados distintos en sitios distintos

Hay algo que las páginas de marketing no mencionan: la mayoría de herramientas gratuitas que extraen texto de imágenes ejecutan el mismo motor de código abierto, Tesseract, compilado a WebAssembly. Revisamos diez y al menos cinco lo dicen abiertamente. Así que cuando un sitio te devuelve texto limpio y otro devuelve galimatías con la misma imagen, el motor rara vez es la variable.

Lo que cambia en cualquier conversión de imagen a texto es lo que llega al motor. Y el factor que más pesa es uno que nadie anuncia: cuántos píxeles de alto tienen las letras. Tesseract quiere unos 20 píxeles de altura por minúscula. Una captura reenviada por un par de aplicaciones de mensajería, o una foto reducida para subirla, suele llegar con la mitad de eso, y la precisión se desploma.

Lo que te dicen las demás herramientas

Que la repitas. De las diez que probamos, el consejo habitual ante un mal resultado es volver a fotografiar o recapturar con mayor resolución. Es un consejo sensato y completamente inútil cuando esa imagen es la única que tienes.

Esta página amplía la imagen antes de leerla y te avisa cuando lo ha hecho. En nuestras pruebas, una captura de 400 por 184 píxeles - lo bastante pequeña como para que casi cualquier herramienta te dijera que empezaras de cero - volvió con un 94% de confianza y todas las líneas correctas. Ampliar no inventa detalle que nunca se capturó, pero le da al motor la altura de letra para la que fue diseñado.

Qué hace realmente el OCR, y qué no

El reconocimiento óptico de caracteres observa el patrón de píxeles claros y oscuros de una imagen y deduce qué caracteres representan probablemente esas formas. No lee ni entiende la página: empareja formas con letras, una a una.

Esa distinción explica casi todas las quejas sobre el OCR. Explica por qué una palabra en una tipografía poco común sale mal, por qué una letra tras una mancha de café se convierte en otra, y por qué el motor produce con total aplomo una palabra que no existe. Es coincidencia de patrones, no comprensión.

También explica por qué toda herramienta capaz de extraer texto de imágenes informa de una puntuación de confianza para cada palabra que devuelve. Esas puntuaciones son información real, y esta página las muestra: cuando la media baja del 70%, el resultado se marca en lugar de entregártelo como si fuera seguro. La mayoría de herramientas lo ocultan.

Para qué se usa de verdad

Capturas y mensajes de error

Copiar texto de una captura que te han enviado, o de un cuadro de error que se niega a dejarse seleccionar.

Recibos y facturas

Sacar importes y números de referencia de un recibo fotografiado en vez de teclearlos otra vez en una hoja de cálculo.

Páginas fotografiadas

Convertir la foto de una página impresa, un libro o un formulario en texto que puedas buscar, editar y pegar.

Documentos que no deberías subir

DNI, informes médicos, contratos. Son justo las imágenes que más conviene mantener fuera del servidor de otra persona.

Cómo extraer texto de una imagen

Puedes extraer texto de imágenes en tres pasos. Sin instalación, sin cuenta y sin paso de subida. La primera ejecución descarga el motor de OCR y los datos del idioma elegido a la caché del navegador; después funciona sin conexión.

  1. 1

    Añade tus imágenes

    Arrastra una foto, captura o escaneo: funcionan JPG, PNG, WebP, BMP y GIF. Puedes añadir hasta 20 a la vez y se procesarán una tras otra.

  2. 2

    Elige los idiomas y la limpieza

    Selecciona todos los idiomas que aparezcan en la imagen, no solo el principal. Deja activada la limpieza para escaneos y fotos; desactívala para capturas, que ya están limpias. Activa el enderezado solo si la página se fotografió en ángulo.

  3. 3

    Extrae, revisa y copia

    El texto aparece en un cuadro editable por imagen, con su puntuación de confianza. Cópialo, descárgalo como .txt o llévatelo todo en un ZIP. Repasa siempre el resultado contra el original: el OCR parece seguro de sí mismo incluso cuando se equivoca.

El motor y los datos de idioma quedan en caché tras la primera ejecución, así que la segunda imagen empieza a leerse de inmediato.

Las tres cosas que deciden si funciona

Cuando extraes texto de imágenes, un mal resultado casi siempre se debe a una de estas, y la primera pesa más que las otras dos juntas.

La resolución, con diferencia

Tesseract quiere unos 20 píxeles de altura por minúscula, lo que en una página entera de texto significa unos mil píxeles en el lado corto. Por debajo de eso la precisión cae bruscamente. Esta página amplía las imágenes pequeñas antes de leerlas y te avisa cuando lo hace: en las pruebas, una captura de 400 por 184 seguía devolviendo todas las líneas correctas. Dicho esto, ampliar una foto borrosa solo da una foto borrosa más grande. Si puedes repetir la toma, llena el encuadre con la página: eso supera cualquier ajuste de este o de cualquier otro sitio.

El contraste, y por qué la limpieza ayuda menos de lo que crees

El motor necesita separar la tinta del papel, así que un escaneo grisáceo o una sombra cruzando media página se lo ponen difícil. La opción de limpieza convierte la imagen a blanco y negro con un umbral adaptativo local, calculado por regiones en vez de una sola vez para toda la imagen, que es lo que necesita una foto con iluminación desigual. Siendo francos sobre la magnitud del efecto: el Tesseract moderno ya hace su propia binarización internamente, así que en una foto razonablemente iluminada la diferencia es pequeña. En nuestras pruebas movió la confianza unos pocos puntos y alguna vez añadió un carácter suelto. Se gana su sitio en escaneos realmente grises y fotos con poca luz, no en capturas.

El ángulo, solo para páginas fotografiadas

El OCR lee en líneas horizontales, así que una página inclinada unos grados hace que las palabras se desplacen entre las filas que el motor va escaneando. El enderezado detecta el ángulo dominante del texto y rota la imagen antes de leer. Actívalo para cualquier cosa fotografiada a pulso en ángulo. Déjalo desactivado para capturas y escaneos planos: ahí no hay inclinación que corregir y la detección solo puede introducir error.

Resumen honesto: empieza por la versión más grande y nítida que tengas. Después usa la limpieza si es un escaneo o una foto oscura, y el enderezado si se tomó en ángulo. Ninguno de los dos rescatará una imagen que ya era demasiado pequeña.

Capturas con más de un idioma: lo único que no hace ninguna otra herramienta

Esto pilla a mucha gente. Todas las herramientas que probamos te piden elegir un único idioma antes de extraer. Para una página en español está bien, pero muchísimas imágenes reales no son así: una factura china con nombres de producto en inglés, una interfaz japonesa con marcas en alfabeto latino, un documento ruso que cita una URL en inglés.

Si eliges un idioma, cualquier intento de extraer texto de imágenes en la otra escritura sale mal, no porque el motor no vea esos caracteres, sino porque los está comparando con el modelo equivocado. Te llevas la mitad del texto y un montón de galimatías donde debería estar la otra mitad.

Tesseract puede cargar varios modelos de idioma a la vez, y esta página te deja seleccionar todos los que necesites. De las diez herramientas que probamos, ninguna ofrece esto: absolutamente todas te obligan a comprometerte con un solo idioma antes de extraer. La contrapartida, dicha con franqueza: cada idioma aumenta los datos descargados la primera vez, y cargar varios hace el reconocimiento algo más lento. Selecciona los que realmente aparecen en tu imagen y no toda la lista.

Lo que esto no hará

El OCR tiene límites reales, y conocerlos antes de extraer texto de imágenes ahorra más tiempo que cualquier ajuste.

Escritura a mano, sobre todo cursiva

Tesseract está entrenado con tipografía impresa. Las mayúsculas de imprenta cuidadas a veces salen; la letra ligada corriente, por lo general no. Es una limitación del motor, no de esta página, y afecta a todas las herramientas gratuitas que lo usan, que son casi todas, aunque la mayoría no lo diga.

Formato y maquetación

Obtienes texto plano. Negritas, cursivas, títulos, color y tipografía se descartan. Las tablas pierden su estructura y quedan como filas de palabras, y una página a dos columnas puede leerse de lado a lado en lugar de columna por columna.

Rescatar una foto realmente mala

La limpieza ayuda con una imagen mediocre. No puede inventar detalle que nunca se capturó: una foto borrosa, oscura o muy pequeña de letra chica no se volverá legible. Repetirla con más resolución supera cualquier procesamiento.

Entender el documento

Devuelve los caracteres que ve, en orden de lectura, y nada más. No sabe qué número es el total ni qué línea es la fecha. Comprueba cualquier cosa sobre la que vayas a actuar.

Comparativa de las herramientas gratuitas

Diez herramientas que extraen texto de imágenes, comprobadas en septiembre de 2026 usando cada una. Solo comportamiento del plan gratuito y solo lo que varía: todas son gratis y la mayoría se ejecuta en el navegador.

HerramientaDónde se ejecutaLotesVarios idiomas a la vez
Esta páginaTu navegadorHasta 20Sí, cualquier combinación
PixConvertTu navegadorDe una en unaNo, solo uno
UtiloKitTu navegadorDe una en unaNo, solo uno
OpenConvertTu navegadorNo, solo uno
PixellizeTu navegadorDe una en unaNo, solo uno
imagetotext.infoNo indicadoPlan de pagoNo, solo uno
OnlineOCR.netSu servidorSolo con cuentaNo, solo uno

El resumen honesto es que varias de estas herramientas de imagen a texto son perfectamente buenas, y las que se ejecutan en tu navegador merecen reconocimiento por ello: eso solía ser el diferenciador y ya no lo es. Dos cosas sí varían: si puedes entregarle un lote entero y si puedes leer una imagen con alfabetos mezclados en una sola pasada. En lo segundo, no encontramos otra herramienta que te lo permita.

Todas las herramientas son 100% gratuitas y seguras

Suite completa de herramientas PDF

Descubre nuestra colección completa de herramientas PDF diseñadas para manejar todas tus necesidades de documentos

Índice de herramientas · 47
01

PNG a PDF

Combina imágenes PNG en un único PDF listo para imprimir

Avg 1.2sLocal
02

JPG a PDF

Convierte imágenes JPG a formato PDF

Avg 1.4sLocal
03

Fusionar PDF

Combina múltiples archivos PDF en uno

Avg 0.8sLocal
04

Comprimir PDF

Reduce el tamaño del archivo PDF eficientemente

Avg 2.1sLocal
05

PDF a PNG

Convierte páginas PDF a imágenes PNG

Avg 1.6sLocal
06

PDF a JPG

Convierte páginas PDF a imágenes JPG

Avg 1.5sLocal
07

PDF a texto

Extrae contenido de texto de archivos PDF

Avg 0.9sLocal
08

Dividir PDF

Divide PDF en páginas separadas

Avg 0.6sLocal
09

Editar PDF

Edita y anota documentos PDF

BetaLocal
10

Organizar PDF

Organiza y reordena páginas PDF

Avg 0.7sLocal
11

Rotar PDF

Rota las páginas de un PDF y guárdalas de forma permanente

Avg 0.5sLocal
12

Números de página

Agrega números de página a un PDF con vista previa en tiempo real

Avg 0.6sLocal
13

Marca de agua PDF

Añade una marca de agua de texto a un PDF con vista previa en tiempo real

Avg 0.6sLocal
14

HEIC a JPG

Convierte fotos HEIC de iPhone a JPG

Avg 1.0sLocal
15

Eliminar páginas PDF

Quita las páginas que te sobran y descarga un PDF limpio

Avg 0.5sLocal
16

Extraer páginas de PDF

Guarda las páginas seleccionadas como un nuevo PDF o en archivos separados

Avg 0.5sLocal
17

Firmar PDF

Dibuja, escribe o sube una firma y colócala en cualquier página

Avg 1.0sLocal
18

Redimensionar PDF

Cambia el tamaño de página a A4, Carta (Letter) o medidas personalizadas

Avg 0.6sLocal
19

Recortar PDF

Elimina márgenes, selecciona arrastrando o recorta automáticamente el espacio en blanco

Avg 0.6sLocal
20

Aplanar PDF

Haz que los formularios sean de solo lectura: mantén el texto con búsqueda o bloquéalo como imagen

Avg 0.7sLocal
21

Metadatos PDF

Consulta, edita o elimina el autor, el título, las fechas y otros metadatos

Avg 0.4sLocal
22

PDF a escala de grises

Convierte a escala de grises o blanco y negro para ahorrar tinta de color

Avg 1.8sLocal
23

Extraer imágenes de un PDF

Saca las fotos, los logotipos y los gráficos incrustados como PNG o JPG

Avg 0.9sLocal
24

WebP a PDF

Convierte imágenes WebP a un PDF y une varias en un solo archivo

Avg 0.7sLocal
25

Proteger PDF

Añade una contraseña de apertura a tu PDF, todo en tu navegador

Avg 0.3sLocal
26

Desbloquear PDF

Quita una contraseña conocida o las restricciones de un PDF, en tu navegador

Avg 1.5sLocal
27

HEIC a PDF

Convierte fotos HEIC de iPhone a PDF

Avg 0.8sLocal
28

AVIF a PDF

Convierte imágenes AVIF a PDF

Avg 0.7sLocal
29

TIFF a PDF

Convierte imágenes y escaneos TIFF a PDF

Avg 1.0sLocal
30

BMP a PDF

Convierte imágenes BMP a PDF

Avg 0.7sLocal
31

OCR PDF

Haz que un PDF escaneado se pueda buscar, todo en tu navegador

Avg 2s/pageLocal
32

Censurar PDF

Elimina definitivamente el texto sensible de un PDF, en tu navegador

Avg 0.3s/pageLocal
33

Comprimir imagen

Reduce JPEG, PNG y WebP por lotes, todo en tu navegador

Avg 0.2sLocal
34

Redimensionar imagen

Cambia las dimensiones en lote, con preajustes, en tu navegador

Avg 0.2sLocal
35

PNG a JPG

Convierte imágenes PNG a JPG por lotes, viendo el tamaño antes de descargar

Avg 0.2sLocal
36

JPG a PNG

Convierte imágenes JPG a PNG por lotes, con fondo transparente opcional

Avg 0.3sLocal
37

WebP a JPG

Convierte archivos WebP a JPG por lotes, con cada fotograma de un WebP animado

Avg 0.3sLocal
38

WebP a PNG

Convierte WebP a PNG conservando la transparencia, o elimina un fondo sólido

Avg 0.3sLocal
39

Imagen a WebP

Convierte JPG, PNG y más a WebP por lotes, o alcanza un tamaño exacto en KB

Avg 0.2sLocal
40

SVG a PNG

Rasteriza SVG al tamaño que quieras o crea un juego de favicons desde un logo

Avg 0.2sLocal
41

AVIF a JPG

Convierte AVIF a JPG para que se abra en cualquier sitio, o ajusta el tamaño en KB

Avg 0.3sLocal
42

Comparar PDF

Ve exactamente qué cambió entre dos versiones de un PDF, sin subir ninguna

Two files, no uploadLocal
43

SVG a JPG

Rasteriza SVG a JPG en cualquier tamaño y elige qué color sustituye a la transparencia

Pick size and backgroundLocal
44

GIF a PNG

Quédate con un fotograma, o divide un GIF animado en un PNG numerado por fotograma

Every frame at onceLocal
45

GIF a JPG

Elige qué sustituye la transparencia, un fotograma o todos, y te decimos cuándo conviene más PNG

You pick the backgroundLocal
46

PDF a TIFF

Convierte un PDF en un único TIFF de varias páginas

One multi-page fileLocal
47

Imagen a texto

Extrae texto de fotos y capturas

11 languages, offlineLocal

Preguntas sobre extraer texto de imágenes

Lo que la gente pregunta antes de extraer texto de imágenes y fiarse del resultado.

¿Es gratis? ¿Tiene límites?

Gratis, sin cuenta, sin tope diario y sin marca de agua. Puedes procesar 20 imágenes a la vez, de hasta 25 MB cada una. Ese límite existe porque el OCR consume mucha CPU y se ejecuta en tu propia máquina, no por un plan de pago. Lanza otro lote justo después.

¿Se suben mis imágenes a algún sitio?

No. El motor de OCR se ejecuta dentro de esta página. Tus imágenes las lee tu propio navegador y nunca se transmiten. Aquí importa más que en otras conversiones, porque las fotos que la gente pasa por OCR son DNI, facturas, informes médicos y contratos.

¿Por qué descargó varios megabytes la primera vez?

Es el motor de OCR y los datos de idioma, y solo ocurre una vez. Como el reconocimiento se ejecuta en local y no en un servidor, el motor tiene que llegar a tu dispositivo. Después queda en caché, así que las siguientes veces empieza al instante, y funciona sin conexión.

¿Puede leer escritura a mano?

No de forma fiable, y la cursiva normalmente nada. El motor está entrenado con tipografía impresa. Las mayúsculas de imprenta cuidadas a veces salen legibles. Esto vale para todas las herramientas gratuitas basadas en Tesseract, que son la mayoría.

El texto salió mal. ¿Qué debería cambiar?

Primero la resolución, luego la limpieza y después el ángulo. Cuando extraes texto de imágenes, un original más grande o más nítido supera cualquier ajuste, y no está reñido. Después, activa la limpieza si es un escaneo gris o una foto oscura, y el enderezado si la página se tomó inclinada. Si tu imagen tiene dos alfabetos, selecciona ambos idiomas en vez de adivinar cuál domina.

¿Puede con una imagen que tenga dos idiomas?

Sí: selecciona todos los presentes, no solo el principal. El motor carga varios modelos a la vez y lee ambos alfabetos en una sola pasada. La mayoría de las otras herramientas te obligan a elegir exactamente uno, y por eso las capturas mixtas vuelven medio vacías de ellas.

¿Conserva la maquetación, las tablas o las negritas?

No. La salida es texto plano. Formato, color y tipografía se descartan, las tablas pierden su estructura y las páginas a varias columnas pueden leerse de lado a lado en vez de hacia abajo. Si necesitas conservar la maquetación, lo que quieres es un PDF con capa de texto, no texto extraído.

¿Y si tengo un PDF en lugar de una imagen?

Usa la herramienta de OCR para PDF: mantiene las páginas intactas. Renderiza cada página, la lee y escribe una capa de texto invisible sobre el original, de modo que el documento parece el mismo pero se vuelve buscable. Convertir el PDF a imágenes y pasarlas por aquí perdería la estructura del documento.

Herramientas relacionadas

Otras herramientas que encajan bien cuando extraes texto de imágenes, todas gratuitas y ejecutándose en tu propio dispositivo.

  • OCR de un PDF para documentos en vez de fotos: añade una capa de texto buscable y mantiene las páginas intactas.
  • PDF a texto cuando el PDF ya tiene texto real dentro y solo hay que extraerlo, sin OCR.
  • Redimensionar una imagen amplía una captura pequeña antes de leerla, o reduce una foto demasiado grande.
  • Comprimir una imagen para cuando la imagen está bien pero el archivo pesa demasiado para enviarlo.
  • PDF a PNG extrae páginas de un PDF como imágenes, si lo que quieres es la imagen y no las palabras.