Descrição
OCR - Leitor de Imagem é uma poderosa extensão de reconhecimento óptico de caracteres (OCR) para Chrome, concebida para capturar e converter imagens em texto editável. Após a instalação, adiciona um botão na barra de ferramentas do seu navegador. Quando ativado, os utilizadores podem selecionar uma região específica na janela ativa para processamento OCR.
A extensão utiliza o motor Tesseract OCR, integrado através da biblioteca "tesseract.js", que suporta mais de 100 idiomas. As funcionalidades principais incluem a deteção automática de orientação de texto e reconhecimento de script, melhorando a precisão e usabilidade em diversas fontes de texto. A biblioteca é carregada sob demanda e removida após o uso, garantindo que não há consumo de recursos a longo prazo.
Dois motores OCR estão disponíveis: Tesseract, que extrai texto simples sem preservar a formatação, e IBM Granite-Docling, capaz de interpretar títulos, listas, estilos (negrito, itálico), tabelas e equações matemáticas. A extensão fornece uma barra de progresso durante a deteção devido à lentidão inerente dos processos OCR. Importante, todo o processamento OCR é realizado offline, sem interação com o servidor, exceto pelo download inicial dos dados de treino de idiomas.
Esta ferramenta é versátil, permitindo aos utilizadores extrair texto de imagens, documentos PDF, diapositivos PowerPoint ou mesmo páginas web onde a seleção de conteúdo possa ser restrita. Para melhorar a precisão, a extensão inclui uma funcionalidade para inverter imagens e tentar novamente o OCR, o que é particularmente benéfico para interfaces com tema escuro. Os utilizadores também podem modificar manualmente imagens e reenviá-las para outra tentativa se a confiança inicial de extração for baixa.
A versão 0.2.4 introduziu suporte para zoom de página a nível do navegador e zoom de ecrã a nível do sistema operativo, juntamente com a deteção de idioma de imagem a nível beta. A extensão é oferecida por brian.girko e obteve uma classificação de 4.1 em 5 de 243 utilizadores, indicando uma receção geralmente positiva para as suas capacidades de OCR.
Recursos principais de OCR
Reconhecimento Óptico de Caracteres (OCR) para conversão de imagem em texto
Motor OCR interno (Tesseract via tesseract.js)
Suporta mais de 100 idiomas
Orientação automática de texto e deteção de script
Processamento OCR offline
Escolha entre os motores Tesseract (texto simples) e IBM Granite-Docling (texto formatado)
Opção de inversão de imagem e tentativa para melhorar a precisão
Capacidade de extrair texto de imagens, PDFs e diapositivos PowerPoint
Extrai texto de páginas web com seleção de conteúdo restrita
Carregamento e descarregamento sob demanda da biblioteca JS
Barra de progresso para módulos de deteção
Suporte para zoom a nível do navegador e do sistema operativo
Deteção de idioma de imagem em beta
Como usar OCR?
Instale a extensão OCR - Leitor de Imagem da Chrome Web Store.
Clique no botão da barra de ferramentas da extensão para a ativar.
Selecione a região desejada no seu ecrã contendo a imagem ou documento.
A extensão capturará a área e realizará o processamento OCR.
Reveja o texto extraído para verificar a precisão.
Se necessário, modifique a imagem e reenvie-a para outra tentativa de OCR.
Casos de uso de OCR
- Extrair texto de imagens
- Digitalizar documentos
- Processar conteúdo PDF
- Capturar texto de páginas web
- Analisar diapositivos de apresentação
- Melhorar a acessibilidade
- Automação de entrada de dados







