Imagen a texto
Extrae el texto de una foto, una captura o un escaneo, directamente en tu navegador. No se sube nada.
No se sube nada
El motor de OCR se ejecuta dentro de esta página. Tu DNI, factura o contrato nunca sale del dispositivo.
Las imágenes pequeñas se amplían
Las capturas por debajo del tamaño útil se escalan a la altura de letra que el motor necesita, en lugar de devolvértelas.
Varios idiomas a la vez
Lee una captura con alfabetos mezclados en una sola pasada, en vez de elegir un idioma y perder la mitad.
Hasta 20 imágenes
Procesa un lote entero y descarga todos los resultados juntos. Sin cuenta y sin límite diario.
En resumen: Para extraer texto de imágenes, suelta una foto o captura, elige el idioma o los idiomas que contiene y recibe el texto. Todo ocurre en tu navegador, así que no se sube nada. Si la imagen es un escaneo o se tomó en ángulo, deja activadas las opciones de limpieza: importan más que la herramienta que elijas.
Por qué la misma foto da resultados distintos en sitios distintos
Hay algo que las páginas de marketing no mencionan: la mayoría de herramientas gratuitas que extraen texto de imágenes ejecutan el mismo motor de código abierto, Tesseract, compilado a WebAssembly. Revisamos diez y al menos cinco lo dicen abiertamente. Así que cuando un sitio te devuelve texto limpio y otro devuelve galimatías con la misma imagen, el motor rara vez es la variable.
Lo que cambia en cualquier conversión de imagen a texto es lo que llega al motor. Y el factor que más pesa es uno que nadie anuncia: cuántos píxeles de alto tienen las letras. Tesseract quiere unos 20 píxeles de altura por minúscula. Una captura reenviada por un par de aplicaciones de mensajería, o una foto reducida para subirla, suele llegar con la mitad de eso, y la precisión se desploma.
Lo que te dicen las demás herramientas
Que la repitas. De las diez que probamos, el consejo habitual ante un mal resultado es volver a fotografiar o recapturar con mayor resolución. Es un consejo sensato y completamente inútil cuando esa imagen es la única que tienes.
Esta página amplía la imagen antes de leerla y te avisa cuando lo ha hecho. En nuestras pruebas, una captura de 400 por 184 píxeles - lo bastante pequeña como para que casi cualquier herramienta te dijera que empezaras de cero - volvió con un 94% de confianza y todas las líneas correctas. Ampliar no inventa detalle que nunca se capturó, pero le da al motor la altura de letra para la que fue diseñado.
Qué hace realmente el OCR, y qué no
El reconocimiento óptico de caracteres observa el patrón de píxeles claros y oscuros de una imagen y deduce qué caracteres representan probablemente esas formas. No lee ni entiende la página: empareja formas con letras, una a una.
Esa distinción explica casi todas las quejas sobre el OCR. Explica por qué una palabra en una tipografía poco común sale mal, por qué una letra tras una mancha de café se convierte en otra, y por qué el motor produce con total aplomo una palabra que no existe. Es coincidencia de patrones, no comprensión.
También explica por qué toda herramienta capaz de extraer texto de imágenes informa de una puntuación de confianza para cada palabra que devuelve. Esas puntuaciones son información real, y esta página las muestra: cuando la media baja del 70%, el resultado se marca en lugar de entregártelo como si fuera seguro. La mayoría de herramientas lo ocultan.
Para qué se usa de verdad
Capturas y mensajes de error
Copiar texto de una captura que te han enviado, o de un cuadro de error que se niega a dejarse seleccionar.
Recibos y facturas
Sacar importes y números de referencia de un recibo fotografiado en vez de teclearlos otra vez en una hoja de cálculo.
Páginas fotografiadas
Convertir la foto de una página impresa, un libro o un formulario en texto que puedas buscar, editar y pegar.
Documentos que no deberías subir
DNI, informes médicos, contratos. Son justo las imágenes que más conviene mantener fuera del servidor de otra persona.
Cómo extraer texto de una imagen
Puedes extraer texto de imágenes en tres pasos. Sin instalación, sin cuenta y sin paso de subida. La primera ejecución descarga el motor de OCR y los datos del idioma elegido a la caché del navegador; después funciona sin conexión.
- 1
Añade tus imágenes
Arrastra una foto, captura o escaneo: funcionan JPG, PNG, WebP, BMP y GIF. Puedes añadir hasta 20 a la vez y se procesarán una tras otra.
- 2
Elige los idiomas y la limpieza
Selecciona todos los idiomas que aparezcan en la imagen, no solo el principal. Deja activada la limpieza para escaneos y fotos; desactívala para capturas, que ya están limpias. Activa el enderezado solo si la página se fotografió en ángulo.
- 3
Extrae, revisa y copia
El texto aparece en un cuadro editable por imagen, con su puntuación de confianza. Cópialo, descárgalo como .txt o llévatelo todo en un ZIP. Repasa siempre el resultado contra el original: el OCR parece seguro de sí mismo incluso cuando se equivoca.
El motor y los datos de idioma quedan en caché tras la primera ejecución, así que la segunda imagen empieza a leerse de inmediato.
Las tres cosas que deciden si funciona
Cuando extraes texto de imágenes, un mal resultado casi siempre se debe a una de estas, y la primera pesa más que las otras dos juntas.
La resolución, con diferencia
Tesseract quiere unos 20 píxeles de altura por minúscula, lo que en una página entera de texto significa unos mil píxeles en el lado corto. Por debajo de eso la precisión cae bruscamente. Esta página amplía las imágenes pequeñas antes de leerlas y te avisa cuando lo hace: en las pruebas, una captura de 400 por 184 seguía devolviendo todas las líneas correctas. Dicho esto, ampliar una foto borrosa solo da una foto borrosa más grande. Si puedes repetir la toma, llena el encuadre con la página: eso supera cualquier ajuste de este o de cualquier otro sitio.
El contraste, y por qué la limpieza ayuda menos de lo que crees
El motor necesita separar la tinta del papel, así que un escaneo grisáceo o una sombra cruzando media página se lo ponen difícil. La opción de limpieza convierte la imagen a blanco y negro con un umbral adaptativo local, calculado por regiones en vez de una sola vez para toda la imagen, que es lo que necesita una foto con iluminación desigual. Siendo francos sobre la magnitud del efecto: el Tesseract moderno ya hace su propia binarización internamente, así que en una foto razonablemente iluminada la diferencia es pequeña. En nuestras pruebas movió la confianza unos pocos puntos y alguna vez añadió un carácter suelto. Se gana su sitio en escaneos realmente grises y fotos con poca luz, no en capturas.
El ángulo, solo para páginas fotografiadas
El OCR lee en líneas horizontales, así que una página inclinada unos grados hace que las palabras se desplacen entre las filas que el motor va escaneando. El enderezado detecta el ángulo dominante del texto y rota la imagen antes de leer. Actívalo para cualquier cosa fotografiada a pulso en ángulo. Déjalo desactivado para capturas y escaneos planos: ahí no hay inclinación que corregir y la detección solo puede introducir error.
Resumen honesto: empieza por la versión más grande y nítida que tengas. Después usa la limpieza si es un escaneo o una foto oscura, y el enderezado si se tomó en ángulo. Ninguno de los dos rescatará una imagen que ya era demasiado pequeña.
Capturas con más de un idioma: lo único que no hace ninguna otra herramienta
Esto pilla a mucha gente. Todas las herramientas que probamos te piden elegir un único idioma antes de extraer. Para una página en español está bien, pero muchísimas imágenes reales no son así: una factura china con nombres de producto en inglés, una interfaz japonesa con marcas en alfabeto latino, un documento ruso que cita una URL en inglés.
Si eliges un idioma, cualquier intento de extraer texto de imágenes en la otra escritura sale mal, no porque el motor no vea esos caracteres, sino porque los está comparando con el modelo equivocado. Te llevas la mitad del texto y un montón de galimatías donde debería estar la otra mitad.
Tesseract puede cargar varios modelos de idioma a la vez, y esta página te deja seleccionar todos los que necesites. De las diez herramientas que probamos, ninguna ofrece esto: absolutamente todas te obligan a comprometerte con un solo idioma antes de extraer. La contrapartida, dicha con franqueza: cada idioma aumenta los datos descargados la primera vez, y cargar varios hace el reconocimiento algo más lento. Selecciona los que realmente aparecen en tu imagen y no toda la lista.
Lo que esto no hará
El OCR tiene límites reales, y conocerlos antes de extraer texto de imágenes ahorra más tiempo que cualquier ajuste.
Escritura a mano, sobre todo cursiva
Tesseract está entrenado con tipografía impresa. Las mayúsculas de imprenta cuidadas a veces salen; la letra ligada corriente, por lo general no. Es una limitación del motor, no de esta página, y afecta a todas las herramientas gratuitas que lo usan, que son casi todas, aunque la mayoría no lo diga.
Formato y maquetación
Obtienes texto plano. Negritas, cursivas, títulos, color y tipografía se descartan. Las tablas pierden su estructura y quedan como filas de palabras, y una página a dos columnas puede leerse de lado a lado en lugar de columna por columna.
Rescatar una foto realmente mala
La limpieza ayuda con una imagen mediocre. No puede inventar detalle que nunca se capturó: una foto borrosa, oscura o muy pequeña de letra chica no se volverá legible. Repetirla con más resolución supera cualquier procesamiento.
Entender el documento
Devuelve los caracteres que ve, en orden de lectura, y nada más. No sabe qué número es el total ni qué línea es la fecha. Comprueba cualquier cosa sobre la que vayas a actuar.
Comparativa de las herramientas gratuitas
Diez herramientas que extraen texto de imágenes, comprobadas en septiembre de 2026 usando cada una. Solo comportamiento del plan gratuito y solo lo que varía: todas son gratis y la mayoría se ejecuta en el navegador.
| Herramienta | Dónde se ejecuta | Lotes | Varios idiomas a la vez |
|---|---|---|---|
| Esta página | Tu navegador | Hasta 20 | Sí, cualquier combinación |
| PixConvert | Tu navegador | De una en una | No, solo uno |
| UtiloKit | Tu navegador | De una en una | No, solo uno |
| OpenConvert | Tu navegador | Sí | No, solo uno |
| Pixellize | Tu navegador | De una en una | No, solo uno |
| imagetotext.info | No indicado | Plan de pago | No, solo uno |
| OnlineOCR.net | Su servidor | Solo con cuenta | No, solo uno |
El resumen honesto es que varias de estas herramientas de imagen a texto son perfectamente buenas, y las que se ejecutan en tu navegador merecen reconocimiento por ello: eso solía ser el diferenciador y ya no lo es. Dos cosas sí varían: si puedes entregarle un lote entero y si puedes leer una imagen con alfabetos mezclados en una sola pasada. En lo segundo, no encontramos otra herramienta que te lo permita.
Suite completa de herramientas PDF
Descubre nuestra colección completa de herramientas PDF diseñadas para manejar todas tus necesidades de documentos
PNG a PDF
Combina imágenes PNG en un único PDF listo para imprimir
JPG a PDF
Convierte imágenes JPG a formato PDF
Fusionar PDF
Combina múltiples archivos PDF en uno
Comprimir PDF
Reduce el tamaño del archivo PDF eficientemente
PDF a PNG
Convierte páginas PDF a imágenes PNG
PDF a JPG
Convierte páginas PDF a imágenes JPG
PDF a texto
Extrae contenido de texto de archivos PDF
Dividir PDF
Divide PDF en páginas separadas
Editar PDF
Edita y anota documentos PDF
Organizar PDF
Organiza y reordena páginas PDF
Rotar PDF
Rota las páginas de un PDF y guárdalas de forma permanente
Números de página
Agrega números de página a un PDF con vista previa en tiempo real
Marca de agua PDF
Añade una marca de agua de texto a un PDF con vista previa en tiempo real
HEIC a JPG
Convierte fotos HEIC de iPhone a JPG
Eliminar páginas PDF
Quita las páginas que te sobran y descarga un PDF limpio
Extraer páginas de PDF
Guarda las páginas seleccionadas como un nuevo PDF o en archivos separados
Firmar PDF
Dibuja, escribe o sube una firma y colócala en cualquier página
Redimensionar PDF
Cambia el tamaño de página a A4, Carta (Letter) o medidas personalizadas
Recortar PDF
Elimina márgenes, selecciona arrastrando o recorta automáticamente el espacio en blanco
Aplanar PDF
Haz que los formularios sean de solo lectura: mantén el texto con búsqueda o bloquéalo como imagen
Metadatos PDF
Consulta, edita o elimina el autor, el título, las fechas y otros metadatos
PDF a escala de grises
Convierte a escala de grises o blanco y negro para ahorrar tinta de color
Extraer imágenes de un PDF
Saca las fotos, los logotipos y los gráficos incrustados como PNG o JPG
WebP a PDF
Convierte imágenes WebP a un PDF y une varias en un solo archivo
Proteger PDF
Añade una contraseña de apertura a tu PDF, todo en tu navegador
Desbloquear PDF
Quita una contraseña conocida o las restricciones de un PDF, en tu navegador
HEIC a PDF
Convierte fotos HEIC de iPhone a PDF
AVIF a PDF
Convierte imágenes AVIF a PDF
TIFF a PDF
Convierte imágenes y escaneos TIFF a PDF
BMP a PDF
Convierte imágenes BMP a PDF
OCR PDF
Haz que un PDF escaneado se pueda buscar, todo en tu navegador
Censurar PDF
Elimina definitivamente el texto sensible de un PDF, en tu navegador
Comprimir imagen
Reduce JPEG, PNG y WebP por lotes, todo en tu navegador
Redimensionar imagen
Cambia las dimensiones en lote, con preajustes, en tu navegador
PNG a JPG
Convierte imágenes PNG a JPG por lotes, viendo el tamaño antes de descargar
JPG a PNG
Convierte imágenes JPG a PNG por lotes, con fondo transparente opcional
WebP a JPG
Convierte archivos WebP a JPG por lotes, con cada fotograma de un WebP animado
WebP a PNG
Convierte WebP a PNG conservando la transparencia, o elimina un fondo sólido
Imagen a WebP
Convierte JPG, PNG y más a WebP por lotes, o alcanza un tamaño exacto en KB
SVG a PNG
Rasteriza SVG al tamaño que quieras o crea un juego de favicons desde un logo
AVIF a JPG
Convierte AVIF a JPG para que se abra en cualquier sitio, o ajusta el tamaño en KB
Comparar PDF
Ve exactamente qué cambió entre dos versiones de un PDF, sin subir ninguna
SVG a JPG
Rasteriza SVG a JPG en cualquier tamaño y elige qué color sustituye a la transparencia
GIF a PNG
Quédate con un fotograma, o divide un GIF animado en un PNG numerado por fotograma
GIF a JPG
Elige qué sustituye la transparencia, un fotograma o todos, y te decimos cuándo conviene más PNG
PDF a TIFF
Convierte un PDF en un único TIFF de varias páginas
Imagen a texto
Extrae texto de fotos y capturas
Preguntas sobre extraer texto de imágenes
Lo que la gente pregunta antes de extraer texto de imágenes y fiarse del resultado.
¿Es gratis? ¿Tiene límites?
Gratis, sin cuenta, sin tope diario y sin marca de agua. Puedes procesar 20 imágenes a la vez, de hasta 25 MB cada una. Ese límite existe porque el OCR consume mucha CPU y se ejecuta en tu propia máquina, no por un plan de pago. Lanza otro lote justo después.
¿Se suben mis imágenes a algún sitio?
No. El motor de OCR se ejecuta dentro de esta página. Tus imágenes las lee tu propio navegador y nunca se transmiten. Aquí importa más que en otras conversiones, porque las fotos que la gente pasa por OCR son DNI, facturas, informes médicos y contratos.
¿Por qué descargó varios megabytes la primera vez?
Es el motor de OCR y los datos de idioma, y solo ocurre una vez. Como el reconocimiento se ejecuta en local y no en un servidor, el motor tiene que llegar a tu dispositivo. Después queda en caché, así que las siguientes veces empieza al instante, y funciona sin conexión.
¿Puede leer escritura a mano?
No de forma fiable, y la cursiva normalmente nada. El motor está entrenado con tipografía impresa. Las mayúsculas de imprenta cuidadas a veces salen legibles. Esto vale para todas las herramientas gratuitas basadas en Tesseract, que son la mayoría.
El texto salió mal. ¿Qué debería cambiar?
Primero la resolución, luego la limpieza y después el ángulo. Cuando extraes texto de imágenes, un original más grande o más nítido supera cualquier ajuste, y no está reñido. Después, activa la limpieza si es un escaneo gris o una foto oscura, y el enderezado si la página se tomó inclinada. Si tu imagen tiene dos alfabetos, selecciona ambos idiomas en vez de adivinar cuál domina.
¿Puede con una imagen que tenga dos idiomas?
Sí: selecciona todos los presentes, no solo el principal. El motor carga varios modelos a la vez y lee ambos alfabetos en una sola pasada. La mayoría de las otras herramientas te obligan a elegir exactamente uno, y por eso las capturas mixtas vuelven medio vacías de ellas.
¿Conserva la maquetación, las tablas o las negritas?
No. La salida es texto plano. Formato, color y tipografía se descartan, las tablas pierden su estructura y las páginas a varias columnas pueden leerse de lado a lado en vez de hacia abajo. Si necesitas conservar la maquetación, lo que quieres es un PDF con capa de texto, no texto extraído.
¿Y si tengo un PDF en lugar de una imagen?
Usa la herramienta de OCR para PDF: mantiene las páginas intactas. Renderiza cada página, la lee y escribe una capa de texto invisible sobre el original, de modo que el documento parece el mismo pero se vuelve buscable. Convertir el PDF a imágenes y pasarlas por aquí perdería la estructura del documento.
Herramientas relacionadas
Otras herramientas que encajan bien cuando extraes texto de imágenes, todas gratuitas y ejecutándose en tu propio dispositivo.
- OCR de un PDF — para documentos en vez de fotos: añade una capa de texto buscable y mantiene las páginas intactas.
- PDF a texto — cuando el PDF ya tiene texto real dentro y solo hay que extraerlo, sin OCR.
- Redimensionar una imagen — amplía una captura pequeña antes de leerla, o reduce una foto demasiado grande.
- Comprimir una imagen — para cuando la imagen está bien pero el archivo pesa demasiado para enviarlo.
- PDF a PNG — extrae páginas de un PDF como imágenes, si lo que quieres es la imagen y no las palabras.