LeanImg

Imagen a Texto — OCR Online Gratis

Extrae texto de capturas de pantalla, escaneos y fotos de documentos, directamente en tu navegador. Gratis, sin registro, nada subido.

Cargando extractor de texto...

¿Quieres agradecernos? ¡Dile a tus amigos sobre LeanImg!

Cómo Extraer Texto de una Imagen

1

Selecciona tus imágenes

Elige archivos o arrástralos y suéltalos en el extractor. JPG, PNG, WebP, GIF, BMP, AVIF y HEIC funcionan todos.

2

Elige un idioma y extrae

Elige el idioma del texto, luego haz clic en Extraer. La primera ejecución en un idioma descarga su modelo a tu navegador.

3

Copia o descarga el texto

Lee el resultado, cópialo a tu portapapeles o guárdalo como un archivo .txt.

¿Por qué LeanImg?

La mayoría de los sitios OCR en línea te piden que subas la imagen primero. Eso es algo extraño de aceptar para una tarjeta de identificación, un recibo de pago o un contrato firmado, y ya no es necesario, porque un navegador moderno puede hacer el reconocimiento por sí mismo. LeanImg extrae texto de imágenes completamente en tu dispositivo, por lo que nada se transmite a ninguna parte. No hay registro, no hay marca de agua y no hay crédito por imagen que comprar, y lee texto en latín, cirílico, griego, árabe y japonés. Las capturas de pantalla y los escaneos limpios son lo que mejor hace, y lo decimos claramente en lugar de prometer precisión perfecta en cada foto. Explora todas nuestras herramientas de imagen gratuitas para mantener el resto de tu trabajo en el navegador también.

Se Ejecuta en Tu Dispositivo

La imagen se lee, reconoce y convierte en texto dentro de esta página. Nada se sube, por lo que los documentos privados permanecen privados.

Gratis e Ilimitado

Sin registro, sin créditos, sin marcas de agua y sin nivel de pago. Ejecuta tantos lotes como desees sin costo.

Lee Varias Escrituras

Se admiten textos en latín, cirílico, griego, árabe y japonés. Elige el idioma y el motor carga el modelo correspondiente.

Cómo lucen los números

Las afirmaciones de precisión son baratas, así que aquí está la medición. Seis fixtures pasaron por este motor, cada uno con su texto conocido de antemano. La puntuación es una comparación carácter por carácter de la salida contra ese texto conocido. Los fixtures son sintéticos. Son páginas HTML renderizadas en un navegador y capturadas como capturas de pantalla reales, y la fila degradada es ese mismo texto bajo un desenfoque y rotación de CSS, por lo que imita una mala captura de teléfono.

Mediciones de ejecuciones reales el 2026-08-11, en hardware de escritorio. La puntuación japonesa se toma con el espaciado normalizado, porque el motor coloca espacios entre los caracteres. Las duraciones se omiten a propósito, ya que un teléfono es más lento que la máquina en la que se ejecutaron.
Imagen de pruebaIdiomaSimilitudConfianza
Captura de pantalla limpiaInglés100.0%95
Párrafo densoInglés100.0%95
Captura degradada simuladaInglés92.4%65
Muestra rusaRuso100.0%96
Muestra japonesaJaponés100.0%93
Foto sin textoInglés515 caracteres de texto inventado32

La última fila es la que hay que leer dos veces. Ese fixture es una fotografía oscura de mariposas sobre un tronco cubierto de musgo, y no hay escritura en ninguna parte. El motor devolvió 515 caracteres de texto que nunca estuvo allí. Los motores OCR hacen esto. Están diseñados para encontrar formas de caracteres, por lo que el grano y la textura se informan como caracteres, y no hay etapa en la cadena que decida que una imagen está en blanco. No afirmamos detectar una imagen vacía, porque no podemos. Cada resultado lleva su puntuación de confianza y se activa una advertencia cuando el promedio cae por debajo de 60. Esa foto obtuvo 32, frente a 95 para una captura de pantalla limpia. El número es lo que hay que leer antes de confiar en el texto.

Lo que se descarga en el primer uso

El reconocimiento se ejecuta en tu máquina, así que la maquinaria tiene que llegar allí primero. Un inicio en frío en inglés son 3 solicitudes y aproximadamente 6 MB, que es el trabajador, el núcleo de WebAssembly y el modelo en inglés. Los tres se sirven desde este sitio y ninguno de ellos es un CDN de terceros. Tu navegador los almacena en caché, así que la segunda ejecución en ese idioma comienza sin nada que buscar. Cada idioma adicional agrega su propio modelo, entre aproximadamente 0.6 y 2 MB dependiendo del script, y los nueve juntos son aproximadamente 11 MB. Nada viaja en la otra dirección: tu imagen se lee en la página y se entrega al motor en memoria, y ninguna solicitud la saca.

Dónde funciona y dónde falla

Las capturas de pantalla y los escaneos limpios son el buen caso, y la tabla muestra cuán bueno: tres fixtures regresaron al 100.0%, carácter por carácter. La fila degradada es la útil. Un desenfoque y una pequeña rotación sobre el mismo texto costaron 7.6 puntos de similitud y empujaron la confianza de 95 a 65, lo cual es lo suficientemente bajo como para activar la advertencia en la tarjeta de resultados. Eso es aproximadamente lo que hace una foto apresurada de un teléfono de una página. La escritura a mano y el texto fotografiado en una escena, como un letrero de tienda o una etiqueta de estante, están fuera de lo que este motor está diseñado para, y no hacemos ninguna afirmación sobre ninguno de los dos. Dale la copia más grande y nítida que tengas. Reducir una captura de pantalla primero desecha los píxeles de los que están hechos los caracteres, así que si el archivo tiene que hacerse más pequeño, envíalo al compresor o al redimensionador una vez que el texto esté fuera.

Preguntas Frecuentes

¿Cómo funciona la extracción de imagen a texto?

OCR significa reconocimiento óptico de caracteres. El motor encuentra las formas en tu imagen, las compara con un modelo entrenado para el idioma que elegiste y escribe los caracteres que reconoce. Todo eso sucede dentro de esta página. LeanImg utiliza Tesseract, el motor OCR de código abierto, compilado a WebAssembly para que se ejecute en tu propio hardware en lugar de en un servidor.

¿Se sube mi imagen a un servidor?

No. Las únicas solicitudes que hace el extractor son para el motor OCR y el modelo de idioma, ambos servidos desde este sitio, y viajan en una sola dirección. Tu imagen se lee desde el disco en la página, se entrega al motor en memoria y se convierte en texto allí. No hay un punto final de carga en el código para recibirla. Eso importa cuando la imagen es una tarjeta de identificación, un recibo de pago o un contrato firmado. Abre tu pestaña de red durante una ejecución: verás archivos de modelo llegando y nada transportando tu imagen.

¿De qué formatos de imagen puedo extraer texto?

JPG, PNG, WebP, GIF y BMP van directamente al motor. AVIF y HEIC se decodifican en la página antes de que el motor los vea, por lo que una foto directamente de un iPhone no necesita convertirse primero. Lo que entra, sale como texto plano.

¿Qué idiomas soporta el OCR?

Inglés, español, rumano, árabe, griego, turco, indonesio, ruso y japonés. Elige el idioma antes de extraer, porque el motor compara formas con el modelo que eliges y el modelo incorrecto se lee mal. El selector comienza en el idioma de la página en la que estás. Aún no hay detección automática de idiomas aquí.

¿Por qué la primera ejecución descarga un modelo?

Porque el reconocimiento ocurre en tu dispositivo, por lo que el modelo tiene que llegar allí primero. La primera vez que usas un idioma, su archivo de datos se descarga y el navegador lo almacena en caché, y las ejecuciones posteriores en ese idioma comienzan inmediatamente. Ese es el intercambio por privacidad. Un servicio OCR alojado sube tu imagen y mantiene el modelo en su propia máquina. Este mantiene tu imagen y obtiene el modelo en su lugar. Cambiar a un idioma que no has usado aún también descarga ese modelo.

¿Es realmente gratis el convertidor de imagen a texto?

Sí, gratis sin cuenta y sin contador de uso. No hay registro, no hay marca de agua en el texto, no hay créditos y no hay un nivel de pago que retenga la buena versión. El trabajo se ejecuta en tu hardware, por lo que no hay costo por imagen en el servidor que tengamos que pasar a ti.

¿Qué tan precisa es la extracción de texto?

Depende de la entrada, y la diferencia es grande. Las capturas de pantalla y los escaneos limpios se leen muy bien, porque los caracteres son nítidos, iluminados uniformemente y están rectos. Las fotografías de papel son menos predecibles, y empeoran con el desenfoque, el deslumbramiento, la sombra o un ángulo inclinado. Hay casos que no pretendemos manejar: escritura a mano y texto en una escena como un letrero de tienda o una etiqueta en una estantería. Este motor está diseñado para caracteres impresos. Otros sitios publicitan precisión perfecta en todo. Esa afirmación no es cierta para ningún motor OCR, incluido este, así que lee la salida antes de confiar en ella.

¿Cuántas imágenes puedo procesar a la vez?

Puedes seleccionar un lote, y la zona de arrastre muestra el límite para una sola ejecución. Las imágenes se procesan en secuencia en lugar de en paralelo, y cada resultado aparece tan pronto como se termina, por lo que puedes comenzar a leer y copiar mientras el resto aún está trabajando. El procesamiento secuencial también mantiene el uso de memoria predecible en los teléfonos.

¿Qué significa la advertencia de baja confianza?

El motor informa cuán seguro está de cada palabra que lee, y la tarjeta de resultado muestra el promedio para la imagen. Cuando ese promedio cae por debajo del umbral que establecimos, obtienes una advertencia en lugar de un resultado que parece limpio. No es un veredicto de que el texto esté mal. Es una señal para verificarlo. En la práctica, se activa en capturas borrosas, bajo contraste, texto muy pequeño y selección de idioma incorrecta.

¿Cómo obtengo mejores resultados de OCR?

Dale al motor caracteres más grandes y nítidos. Captura la fuente en lugar de fotografiarla siempre que sea posible. Si tienes que usar una cámara, dispara de frente en lugar de en ángulo, llena el marco con el texto y mantén la iluminación uniforme para que no haya deslumbramiento o sombra que cruce la página. El texto oscuro sobre un fondo claro se lee mejor. Elige el idioma correcto antes de extraer, ya que esa elección cambia el resultado más que cualquier otra cosa en esta lista.

¿Puedo extraer texto de una captura de pantalla?

Sí, y una captura de pantalla es el mejor caso para esta herramienta. Es texto renderizado: bordes nítidos, fondo plano, sin lente y sin iluminación que combatir. Eso es exactamente para lo que está diseñado un motor OCR de texto impreso. Las capturas de pantalla de mensajes de error, hilos de chat, diálogos de aplicaciones y salida de terminal se procesan bien. El diseño de tabla no se reconstruye, así que obtienes las palabras, no la cuadrícula.

¿Qué puedo hacer con el texto extraído?

Cópialo a tu portapapeles, o descárgalo como un archivo .txt. Cuando procesas un lote, también puedes descargar todo como un solo .txt. No hay salida PDF buscable aquí, y preferiríamos decirlo claramente que insinuarlo: esta herramienta te da texto plano, no un documento reconstruido con el diseño original. Si necesitas las palabras en una hoja de cálculo, un documento o un traductor, pégalas allí.

¿Tienes más preguntas? Aprende más sobre LeanImg y cómo procesamos tus imágenes.

¿Necesitas archivos más pequeños? Comprime tus imágenes para reducir el tamaño del archivo. ¿Necesitas un formato diferente? Convierte entre formatos como JPG, PNG, WebP y AVIF. ¿Necesitas dimensiones diferentes? Redimensiona tus imágenes a un tamaño exacto.