开源OCR工具OCR It 20毫秒将PDF转Markdown,速度比Docling快近300倍
开源OCR工具OCR It以20毫秒的速度将PDF转成Markdown,离线运行且比Docling快近300倍,但复杂排版支持有限。
OCR It 是一款开源文字识别工具,能把 PDF 里的文字提取出来并转成 Markdown 格式,处理一页只需 20 毫秒,比同类工具 Docling 快近 300 倍,且完全离线运行。使用时先框选区域,再按快捷键,就能自动翻页识别整本书。不过,它对表格、公式等复杂排版的识别还不够好。
正文摘录
其联合创始人兼 CTO Nicolas Camara 宣布,他们最新开发的 OCR It 可以在 20ms 内将一份不可复制的 PDF 文件中的所有文字内容提炼完毕,并转换为清晰的 Markdown 格式,AI 读完马上就能看懂。 相当于你刚点完确定还没眨完眼,一份处理好的 Markdown 文件就已经清清爽爽地交到你手上了。 而且它还不需要联网,可以 100% Offline via Bundled Tesseract。 Nicolas Camara 骄傲地表示,在处理质量与 Docling 旗鼓相当的前提下,OCR It 的处理速度比 Docling 快了近 300 倍。 你只需框选一次区域,之后每按一次快捷键(或开启自动模式),它就能把整本书或整个文档变成完整且可编辑的纯文本,方便你直接喂给 AI 进行总结或提问。 期间,OCR It 默认会在连续识别到两张相同页面、无法继续翻页、OCR 失败或达到 300 页上限时自动停止,避免在末页无限重复抓取。 具体而言,手动档和自动档可以分别按以下几个步骤操作:(注:使用 Windows 和 Linux 的朋友们需将 Option 键替换为 Alt) 首先按 Option + Shift + R 选定需要识别的文字区域,确认无误后按 Enter 保存; 完成第一步框选文字区域之后,按一次 Option + Shift + S,OCR It 就会开始识别当前页面,并在识别完成后自动翻到下一页。 如果你希望进一步节省时间,也可以一边翻页一边在每一页按一次 Option + Shift + S,系统会立即截图并在后台自动排队执行识别任务。 自动档就简单多了,你只需要按下 Option + Shift + A 或点击 Start auto-run,OCR It 便会自动循环执行“截图—OCR—翻页”,直至文档结束。