OCR It: извлекайте текст из невыбираемых документов для LLM

OCR It – pull text out of un-copyable documents for your LLM

OCR It: извлекайте текст из невыбираемых документов для LLM

OCR It — это расширение для Chrome, которое позволяет выделить область экрана один раз и затем с помощью горячих клавиш извлекать текст из каждой страницы документа, где текст нельзя скопировать: сканированные книги, презентации, PDF. OCR выполняется полностью локально через встроенный Tesseract, без отправки данных в интернет. Поддерживает автоматический режим, который сам перелистывает страницы и останавливается в конце документа. Результат можно скопировать или сохранить в .txt и передать в LLM для анализа.

OCR работает локально с встроенной сборкой Tesseract. Никаких API-ключей, никакой сети, никакие изображения не покидают ваш компьютер — расширение вообще не совершает исходящих запросов.
  1. thiagolima

    Я добавил поддержку Firefox. Сборки 0.3.0 для обоих браузеров из одного исходного кода, и они отправлены на проверку и для Google/Chrome, и для Mozilla/Firefox. Сейчас жду ревью, обычно это занимает несколько дней.

    Пока не одобрят, можете скачать готовые сборки:

    Скачайте ocr-it-firefox-0.3.0.zip с https://github.com/thiagotigaz/ocr-it/releases/tag/v0.3.0

    Если предпочитаете собирать из исходников, шаги описаны в README: https://github.com/thiagotigaz/ocr-it#install

  2. andreashaerter

    Если вы используете Linux-десктоп (я на Fedora), Gradia[1][2] тоже определённо стоит внимания.

    У него похожий рабочий процесс: делаете скриншот и сразу же аннотируете или редактируете его, не открывая отдельный редактор изображений. И ещё: он также предоставляет локальную функцию OCR (поэтому я и комментирую здесь) — можно извлечь текст из скриншота с помощью экранного OCR на базе Tesseract, нажав маленькую кнопку рядом с «Crop Image».

    В сочетании с функцией подсветки синтаксиса для скриншотов фрагментов кода OCR оказывается на удивление полезным, например, когда нужно быстро обсудить код в чате, а копирование заблокировано по какой-то причине (например, вам прислали скриншот).

    [1] https://gradia.alexandervanhee.be/

    [2] https://flathub.org/en/apps/be.alexandervanhee.gradia

    Исправлено: исправил неправильные номера ссылок

  3. rickcarlino

    Tesseract всё ещё лучший выбор для локального OCR в 2026 году? Меня всегда разочаровывала его реальная производительность.

  4. tobinfekkes

    Также доступен нативно в ОС (Windows) через PowerToys, если хотите альтернативу браузерному расширению. Один из недооценённых героев этой библиотеки.

    Вопрос о том, кому больше доверять в обработке личных данных — Microsoft или Google, остаётся открытым. Никому.

  5. Barbing

    «Зафиксируйте область один раз. Нажимайте горячую клавишу на каждой странице. Получите всю книгу в виде текста».

    Гораздо лучше старого определения «региональной блокировки», приятно.

    HN не в восторге от сгенерированных README, хотя софт, сделанный на вибе (тщательно использованный), может быть вполне хорош.

Ещё за этот день

2026-08-24