OCR It: Chrome 확장 프로그램으로 복사 불가 문서를 LLM에 넣을 텍스트로

OCR It – pull text out of un-copyable documents for your LLM

OCR It: Chrome 확장 프로그램으로 복사 불가 문서를 LLM에 넣을 텍스트로

OCR It은 Chrome 확장 프로그램으로, 스캔된 책, 슬라이드, PDF 등 텍스트 선택이 불가능한 페이지가 많은 문서에서 텍스트를 추출해줍니다. 사용자가 화면 영역을 한 번 지정하면, 단축키(⌥⇧S)를 누를 때마다 해당 영역을 캡처하고 OCR하여 텍스트를 수집합니다. 자동 실행 모드(⌥⇧A)는 페이지 넘김까지 처리하여 문서 끝까지 반복합니다. OCR은 번들된 Tesseract를 사용해 100% 오프라인으로 실행되며, API 키나 네트워크 요청이 필요 없어 이미지가 외부로 유출되지 않습니다. 추출된 텍스트는 편집 가능한 목록으로 저장되며, 복사하거나 .txt 파일로 다운로드할 수 있습니다. LLM(예: Claude, ChatGPT)에 붙여넣어 요약, 검색, 질의응답에 활용하기 좋습니다.

OCR은 로컬에서 번들된 Tesseract 빌드로 실행됩니다. API 키도, 네트워크도, 이미지가 기기를 떠나는 일도 없습니다 — 확장 프로그램은 외부 요청을 전혀 보내지 않습니다.
  1. thiagolima

    Firefox 지원을 추가했습니다. 0.3.0 버전은 동일한 소스에서 두 브라우저용으로 빌드되며, Google/Chrome과 Mozilla/Firefox 양쪽에 제출했습니다. 현재 리뷰를 기다리는 중인데, 보통 며칠 정도 걸립니다.

    승인될 때까지 여러분은 바로 사용 가능한 릴리스를 다운로드할 수 있습니다:

    https://github.com/thiagotigaz/ocr-it/releases/tag/v0.3.0 에서 ocr-it-firefox-0.3.0.zip 다운로드

    소스에서 직접 빌드하고 싶다면, README에 단계가 있습니다: https://github.com/thiagotigaz/ocr-it#install

  2. andreashaerter

    Linux 데스크톱을 사용한다면(Fedora를 쓰고 있습니다), Gradia[1][2]도 확실히 살펴볼 가치가 있습니다.

    별도의 이미지 편집기를 열지 않고도 스크린샷을 찍은 다음 바로 주석을 달거나 편집할 수 있는 비슷한 워크플로우를 제공합니다. 그리고: 로컬 OCR 기능도 제공합니다(그래서 여기에 댓글을 답니다). "Crop Image" 버튼 옆의 작은 버튼을 사용하여 Tesseract로 화면의 텍스트를 추출할 수 있습니다.

    코드 스니펫 스크린샷의 구문 강조 기능과 결합하면, OCR은 예를 들어 어떤 이유로 복사가 차단된 코드를 채팅에서 빠르게 논의할 때(예: 누군가 처음부터 스크린샷을 보냈을 때) 놀랍도록 유용합니다.

    [1] https://gradia.alexandervanhee.be/

    [2] https://flathub.org/en/apps/be.alexandervanhee.gradia

    편집: 잘못된 링크 인덱스 번호 수정

  3. rickcarlino

    2026년에도 Tesseract가 로컬 OCR에 가장 좋은 선택인가요? 저는 항상 실제 성능에 실망했었습니다.

  4. tobinfekkes

    브라우저 확장 프로그램의 대안으로, OS에 기본 제공되는 PowerToys(Windows)로도 사용할 수 있습니다. 그 라이브러리에서 과소평가된 영웅 중 하나입니다.

    개인 데이터 처리에 있어 어느 쪽이 더 신뢰할 수 있는지는 아직 판단하기 어렵습니다. Microsoft 또는 Google. 둘 다 아닙니다.

  5. Barbing

    "영역을 한 번 고정하세요. 모든 페이지에서 단축키를 누르세요. 책 전체를 텍스트로 얻으세요."

    기존의 "지역 잠금" 정의보다 훨씬 낫네요. 좋습니다.

    HN은 생성된 README를 좋아하지 않지만, 철저히 사용된 바이브 코딩 소프트웨어는 모두 좋을 수 있습니다.

이 날의 다른 글

2026-08-24