Описание
OCR - Image Reader — это мощное расширение для Chrome с функцией оптического распознавания символов (OCR), предназначенное для захвата и преобразования изображений в редактируемый текст. После установки оно добавляет кнопку на панель инструментов браузера. При активации пользователи могут выбрать определенную область в активном окне для обработки OCR.
Расширение использует движок Tesseract OCR, интегрированный через библиотеку "tesseract.js", которая поддерживает более 100 языков. Ключевые функции включают автоматическое определение ориентации текста и распознавание скрипта, что повышает точность и удобство использования для различных источников текста. Библиотека загружается по запросу и удаляется после использования, обеспечивая отсутствие долгосрочного потребления ресурсов.
Доступны два движка OCR: Tesseract, который извлекает обычный текст без сохранения форматирования, и IBM Granite-Docling, способный интерпретировать заголовки, списки, стили (полужирный, курсив), таблицы и математические уравнения. Расширение отображает индикатор выполнения во время обнаружения из-за присущей медлительности процессов OCR. Важно отметить, что вся обработка OCR выполняется в автономном режиме, без взаимодействия с сервером, за исключением первоначальной загрузки данных для обучения языков.
Этот инструмент универсален и позволяет пользователям извлекать текст из изображений, PDF-документов, слайдов PowerPoint или даже веб-страниц, где выбор контента может быть ограничен. Для повышения точности расширение включает функцию инвертирования изображений и повторной попытки OCR, что особенно полезно для интерфейсов с темной темой. Пользователи также могут вручную изменять изображения и повторно загружать их для другой попытки, если начальная уверенность в извлечении низкая.
Версия 0.2.4 добавила поддержку масштабирования страниц на уровне браузера и масштабирования экрана на уровне ОС, а также бета-версию определения языка изображений. Расширение предлагается brian.girko и получило оценку 4,1 из 5 от 243 пользователей, что указывает на в целом положительный прием его возможностей OCR.
Основные функции OCR
Оптическое распознавание символов (OCR) для преобразования изображений в текст
Встроенный движок OCR (Tesseract через tesseract.js)
Поддержка более 100 языков
Автоматическое определение ориентации текста и скрипта
Автономная обработка OCR
Выбор между движками Tesseract (обычный текст) и IBM Granite-Docling (форматированный текст)
Инвертирование изображения и опция повторной попытки для повышения точности
Возможность извлечения текста из изображений, PDF и слайдов PowerPoint
Извлекает текст с веб-страниц с ограниченным выбором контента
Загрузка и выгрузка JS-библиотеки по запросу
Индикатор выполнения для модулей обнаружения
Поддержка масштабирования на уровне браузера и ОС
Бета-версия определения языка изображений
Как использовать OCR?
Установите расширение OCR - Image Reader из Chrome Web Store.
Нажмите кнопку расширения на панели инструментов, чтобы активировать его.
Выберите нужную область на экране, содержащую изображение или документ.
Расширение захватит область и выполнит обработку OCR.
Проверьте извлеченный текст на точность.
При необходимости измените изображение и загрузите его повторно для новой попытки OCR.
Варианты использования OCR
- Извлечение текста из изображений
- Оцифровка документов
- Обработка содержимого PDF
- Захват текста веб-страницы
- Анализ слайдов презентации
- Повышение доступности
- Автоматизация ввода данных







