Extrae texto de documentos no copiables para tu LLM con OCR It
OCR It – pull text out of un-copyable documents for your LLM

OCR It es una extensión de Chrome que extrae texto de documentos paginados atrapados en visores, como libros escaneados, presentaciones o PDFs. Fija una región de captura una vez y luego con un atajo de teclado captura, OCR y acumula el texto de cada página, o deja que la extensión haga todo automáticamente. El OCR se ejecuta 100% local con Tesseract, sin necesidad de API key ni conexión a internet. El texto resultante se puede exportar como archivo .txt o copiar, listo para alimentar a un LLM como ChatGPT o Claude.
Sin API key, sin red, sin que las imágenes salgan de tu máquina: la extensión no realiza ninguna solicitud saliente.
- thiagolima
Añadí soporte para Firefox. La versión 0.3.0 se compila para ambos navegadores desde la misma fuente, y está enviada para google/chrome y mozilla/firefox; estoy esperando las revisiones, que normalmente tardan unos días. Hasta que se apruebe, podéis descargar las versiones listas para usar:
Descarga ocr-it-firefox-0.3.0.zip desde https://github.com/thiagotigaz/ocr-it/releases/tag/v0.3.0
Si prefieres compilar desde el código fuente, los pasos están en el README: https://github.com/thiagotigaz/ocr-it#install
- andreashaerter
Si usas un escritorio Linux (yo estoy en Fedora), Gradia[1][2] definitivamente merece la pena echarle un vistazo también.
Tiene un flujo de trabajo similar para hacer capturas de pantalla y luego anotarlas o editarlas inmediatamente, sin tener que abrir un editor de imágenes aparte. Y además: ofrece también una función de OCR local (por eso comento aquí), puedes extraer texto de una captura con OCR en pantalla usando Tesseract con el pequeño botón al lado del de "Recortar imagen".
Combinado con la función de resaltado de sintaxis para capturas de fragmentos de código, el OCR es sorprendentemente útil si, por ejemplo, discutes rápidamente algo de código en un chat cuando la copia está bloqueada por cualquier motivo (p. ej., alguien te ha enviado una captura en primer lugar).
[1] https://gradia.alexandervanhee.be/
[2] https://flathub.org/en/apps/be.alexandervanhee.gradia
Edición: corregidos los números de enlace incorrectos
- rickcarlino
¿Sigue siendo Tesseract la mejor opción para OCR local en 2026? Siempre me decepcionó su rendimiento en el mundo real.
- tobinfekkes
También está disponible de forma nativa en el sistema operativo (Windows) con PowerToys, si quieres una alternativa a una extensión de navegador. Uno de los héroes anónimos de esa biblioteca.
Aún está por ver cuál es más confiable en cuanto al manejo de datos personales, si Microsoft o Google. Ninguno.
- Barbing
"Fija una región una vez. Pulsa una tecla de acceso rápido en cada página. Obtén el libro entero como texto."
Mucho mejor que la vieja definición de "bloqueo regional", bonito.
A HN no le gustan los README generados, aunque el software con vibes (usado a fondo) puede ser perfectamente bueno.