Descripción
OCR - Lector de Imágenes es una potente extensión de Chrome con reconocimiento óptico de caracteres (OCR) diseñada para capturar y convertir imágenes en texto editable. Tras la instalación, añade un botón en la barra de herramientas de su navegador. Cuando se activa, los usuarios pueden seleccionar una región específica dentro de la ventana activa para el procesamiento OCR.
La extensión utiliza el motor Tesseract OCR, integrado a través de la biblioteca "tesseract.js", que presume de soporte para más de 100 idiomas. Las características clave incluyen la detección automática de la orientación del texto y el reconocimiento de escritura, mejorando la precisión y la usabilidad en diversas fuentes de texto. La biblioteca se carga bajo demanda y se elimina después de su uso, asegurando que no haya consumo de recursos a largo plazo.
Hay dos motores OCR disponibles: Tesseract, que extrae texto plano sin conservar el formato, e IBM Granite-Docling, capaz de interpretar encabezados, listas, estilos (negrita, cursiva), tablas y ecuaciones matemáticas. La extensión proporciona una barra de progreso durante la detección debido a la lentitud inherente de los procesos OCR. Es importante destacar que todo el procesamiento OCR se realiza sin conexión, sin interacción del lado del servidor, excepto la descarga inicial de los datos de entrenamiento de idiomas.
Esta herramienta es versátil, permitiendo a los usuarios extraer texto de imágenes, documentos PDF, diapositivas de PowerPoint o incluso páginas web donde la selección de contenido pueda estar restringida. Para mejorar la precisión, la extensión incluye una función para invertir imágenes y reintentar el OCR, lo cual es particularmente beneficioso para interfaces con tema oscuro. Los usuarios también pueden modificar manualmente las imágenes y volver a cargarlas para otro intento si la confianza inicial de extracción es baja.
La versión 0.2.4 introdujo soporte para el zoom de página a nivel de navegador y el zoom de pantalla a nivel de sistema operativo, junto con la detección de idioma de imagen a nivel beta. La extensión es ofrecida por brian.girko y ha obtenido una calificación de 4.1 sobre 5 de 243 usuarios, lo que indica una recepción generalmente positiva para sus capacidades de OCR.
Características principales de OCR
Reconocimiento Óptico de Caracteres (OCR) para conversión de imagen a texto
Motor OCR interno (Tesseract a través de tesseract.js)
Soporta más de 100 idiomas
Orientación automática del texto y detección de escritura
Procesamiento OCR sin conexión
Elección entre motores Tesseract (texto plano) e IBM Granite-Docling (texto con formato)
Opción de invertir imagen y reintentar para mejorar la precisión
Capacidad para extraer texto de imágenes, PDFs y diapositivas de PowerPoint
Extrae texto de páginas web con selección de contenido restringida
Carga y descarga bajo demanda de la biblioteca JS
Barra de progreso para módulos de detección
Soporte para zoom a nivel de navegador y sistema operativo
Detección de idioma de imagen en beta
¿Cómo usar OCR?
Instale la extensión OCR - Lector de Imágenes desde la Chrome Web Store.
Haga clic en el botón de la barra de herramientas de la extensión para activarla.
Seleccione la región deseada en su pantalla que contenga la imagen o el documento.
La extensión capturará el área y realizará el procesamiento OCR.
Revise el texto extraído para verificar su precisión.
Si es necesario, modifique la imagen y vuelva a cargarla para otro intento de OCR.
Casos de uso de OCR
- Extraer texto de imágenes
- Digitalizar documentos
- Procesar contenido PDF
- Capturar texto de páginas web
- Analizar diapositivas de presentación
- Mejorar la accesibilidad
- Automatización de entrada de datos







