OCR It:一键提取不可复制文档给 LLM
OCR It – pull text out of un-copyable documents for your LLM

面对无法复制的扫描件或 PDF,OCR It 这款 Chrome 扩展能帮你轻松提取文本。只需一次划定区域,通过快捷键即可逐页截图并调用本地 Tesseract 引擎进行离线 OCR 识别。它支持自动翻页和批量处理,将数百页文档瞬间转化为可编辑文本,直接喂给 Claude 或 ChatGPT 进行总结与问答。全程无需 API 密钥,所有数据都在本地处理,确保隐私安全,是处理受限文档的绝佳工具。
OCR 完全在本地运行,无需 API 密钥,无需网络连接,你的图片绝不会离开本机。
HN 评论区
36- thiagolima
我已经添加了 Firefox 支持。0.3.0 版本基于同一套源码构建了两个浏览器的版本,并已提交至 Google/Chrome 和 Mozilla/Firefox 商店,目前正在等待审核,通常这需要几天时间。
在审核通过之前,大家可以下载现成的发布版:
从 https://github.com/thiagotigaz/ocr-it/releases/tag/v0.3.0 下载 ocr-it-firefox-0.3.0.zip
如果你更喜欢从源码构建,步骤在 README 里:https://github.com/thiagotigaz/ocr-it#install
- andreashaerter
如果你使用的是 Linux 桌面(我用的是 Fedora),Gradia[1][2] 也绝对值得一看。
它的工作流类似:截取屏幕截图后,可以直接进行标注或编辑,无需打开单独的图像编辑器。此外:它还提供了本地 OCR 功能(这也是我在此评论的原因),你可以使用 Tesseract 通过“裁剪图像”按钮旁边的小按钮,利用屏幕 OCR 从截图中提取文本。
结合代码片段截图的语法高亮功能,OCR 功能组合起来意外地实用。例如,当复制功能因某种原因被禁用时(比如有人直接给你发了截图),你可以迅速在聊天中讨论代码。
[1] https://gradia.alexandervanhee.be/
[2] https://flathub.org/en/apps/be.alexandervanhee.gradia
编辑:修正了错误的链接索引编号
- rickcarlino
2026 年了,Tesseract 仍然是本地 OCR 的最佳选择吗?我对它在实际场景中的表现一直不太满意。
- tobinfekkes
如果你想要浏览器扩展之外的替代方案,Windows 系统原生也支持,可以通过 PowerToys 实现。它是该库中一位鲜为人知的英雄。
至于微软和谷歌谁在处理个人数据时更值得信赖,目前尚无定论。答案是:都不行。
- Barbing
“锁定一个区域。在每一页按下热键。整本书瞬间变成文本。”
这比旧版“区域锁定”的定义好多了,真不错。
不过 HN 社区似乎不太喜欢那种生成的 README,虽然那些靠“感觉”做出来的软件(只要用得顺手)其实也没问题。