Imagen a texto (OCR)

Extrae el texto de fotos, capturas de pantalla y escaneos en tu navegador; luego edítalo, cópialo o guárdalo como archivo .txt. No se sube nada.

El formulario interactivo está listo al activar JavaScript.

Cómo utilizar

Elige una o varias imágenes, arrástralas a la herramienta o pega una captura de pantalla con Ctrl+V. La herramienta las lee una tras otra y pone todo el texto en un único cuadro, donde puedes corregirlo antes de copiarlo o descargarlo como archivo .txt. Si hay varias imágenes, cada una empieza con una línea que muestra el nombre de su archivo, para que sepas de dónde procede cada parte.

Elige el idioma del texto antes de añadir las imágenes. Si lo cambias después, o cambias el orden de lectura, las imágenes se vuelven a leer. El idioma importa porque le indica al motor qué letras y acentos esperar: un texto en portugués leído como inglés puede perder acentos como los de la ç y la ã. El orden de lectura importa para la disposición: «Línea a línea» mantiene unida cada fila de una tabla o de un tique, mientras que «Columnas y bloques» lee una página con columnas columna por columna.

El motor de reconocimiento es Tesseract, el motor de OCR de código abierto, que funciona en tu navegador como WebAssembly. Tus imágenes no se suben a nTools ni a ningún otro servicio. La primera vez, el navegador descarga el motor (unos 1,5 MB) y los datos del idioma elegido (de 0,7 a 3 MB); después, normalmente se cargan desde la caché del navegador.

El motor se entrenó con texto impreso. No admite texto manuscrito, y las fotos borrosas, el texto inclinado, las letras muy pequeñas, las fuentes decorativas y el texto claro sobre un fondo recargado producen errores. Las imágenes pequeñas, como la mayoría de las capturas de pantalla, se amplían automáticamente antes de leerlas, lo que ayuda con el texto pequeño de las interfaces. La confianza que se muestra es la estimación del propio motor, promediada sobre el texto que ha encontrado: una señal de alerta útil, no una garantía, así que comprueba los nombres, los números y los importes con la imagen.

Los archivos TIFF se leen página a página, incluidos los escaneos de varias páginas y los archivos con compresión ZIP, LZW, JPEG o de fax. Las fotos JPEG y HEIC se colocan en la posición correcta según su información de orientación, pero el texto que aparece de lado o al revés en la propia imagen no se gira. Cada imagen puede tener hasta 30 MB, 40 megapíxeles y 12.000 píxeles por lado, y se pueden leer hasta 20 archivos a la vez (un TIFF de varias páginas cuenta como uno).

Ejemplo

  • Captura de pantalla de un mensaje de error (PNG)El mensaje como texto que puedes pegar en una búsqueda o en una solicitud de soporte.
  • Foto de una carta impresa, hecha de frente (JPEG)El texto de la carta, listo para corregirlo y guardarlo como archivo .txt.
  • TIFF de varias páginas de un escánerEl texto de todas las páginas, cada una encabezada con el nombre del archivo y el número de página.
  • Foto de un tique de compra, leída línea a líneaCada artículo junto a su precio en la misma línea. Revisa los importes: un 5 puede leerse como una S, o una coma como un punto.

Preguntas frecuentes

¿Se suben mis imágenes?

No. El texto se reconoce en tu navegador, y las imágenes y el texto se quedan en tu dispositivo. El navegador descarga de nTools solo lo que necesita para leerlas: el motor de reconocimiento, los datos del idioma y, para los archivos TIFF o HEIC, un decodificador. Con estas solicitudes no se envía ninguna imagen ni ningún texto.

¿Puede leer texto manuscrito?

No. El motor se entrenó con texto impreso, así que el texto manuscrito da malos resultados, salvo que sea muy regular, parecido a las mayúsculas de imprenta.

¿Por qué hay texto incorrecto o que falta?

Las causas habituales son una foto borrosa o inclinada, letras pequeñas o tenues, un fondo recargado o haber elegido un idioma equivocado. Haz la foto de frente y con buena luz, o recorta la imagen para dejar solo el texto, y vuelve a intentarlo. Para tablas y tiques, usa el orden de lectura «Línea a línea».

¿Puedo extraer el texto de un PDF?

Aquí no: esta herramienta lee imágenes. Si el PDF se escaneó, convierte sus páginas en imágenes PNG a 144 DPI con la herramienta «PDF a imágenes» y lee esas imágenes. Si puedes seleccionar el texto en el PDF, ya es texto, así que copiarlo es más preciso que el OCR.

¿Conserva el formato?

No. El resultado es texto sin formato con saltos de línea, sin fuentes, negritas, columnas ni tablas. Eso es lo que contiene un archivo .txt.

Herramientas relacionadas