3秒可处理200份PDF:开源OCR工具OCR It爆火,速度比Docling快300倍
曾经只能手动摘取 PDF 文字,结果却是一堆乱码,连大语言模型(LLM)也无法识别的痛苦日子,终于要结束了!

Y Combinator 孵化的明星项目 Firecrawl 团队最近放出了一个大招:
其联合创始人兼 CTO Nicolas Camara 宣布,他们最新开发的 OCR It 可以在 20 毫秒内完成一份不可复制 PDF 文件中所有文字内容的提炼,并将其转化为清晰的 Markdown 格式,方便 AI 立即阅读和理解。

20 毫秒是什么概念?
相当于你刚点击完确定,还没来得及眨眼,一份排版整洁的 Markdown 文件就已经呈现在你面前了。
而且它完全不需要联网,可以 100% 离线运行(via Bundled Tesseract)。
这款刚刚开源的 OCR 工具一经发布,便在 GitHub 上收获了极高的关注度。
Nicolas Camara 骄傲地表示,在处理质量与 Docling 旗鼓相当的前提下,OCR It 的处理速度比 Docling 快了近 300 倍!

网友们测试后也纷纷在 X 上留言:
快,确实非常快!

OCR It 怎么用
首先,OCR It 是一款适用于 Chrome 和 Firefox 的免费浏览器插件。
你只需框选一次区域,之后每按一次快捷键(或开启自动模式),它就能把整本书或整个文档转化为完整且可编辑的纯文本,方便直接喂给 AI 进行总结或提问。
在此期间,OCR It 默认在连续识别到两张相同页面、无法继续翻页、OCR 失败或达到 300 页上限时自动停止,以避免在最后一页无限重复抓取。

具体而言,手动模式和自动模式可以分别按照以下步骤操作:
(注:Windows 和 Linux 用户需将 Option 键替换为 Alt 键)
1. 手动模式
- 框选和识别: 首先按下 Option + Shift + R 选定需要识别的文字区域,确认无误后按 Enter 键保存。 完成第一步框选后,按一次 **Option + Shift
