相关疑难解决方法(0)

批量 OCR 许多 PDF

这已经在一年前在这里讨论过:

许多 PDF 文件的批处理 OCR(尚未 OCR)?

有没有办法批量处理尚未经过 OCR 处理的 OCR PDF?我认为,这是处理两个问题的当前状态:

批量 OCR PDF

视窗

  • Acrobat – 这是最直接的 OCR 批处理引擎。唯一的问题似乎是 1)它不会跳过已经被 OCR 处理过的文件 2)尝试向它扔一堆 PDF(一些旧的)并看着它崩溃。这是一个小马车。它会在遇到的每个错误时向您发出警告(尽管您可以告诉软件不要通知。但同样,它在某些类型的 PDF 上会死得很惨,因此您的里程可能会有所不同。

  • ABBYY FineReader (Batch/Scansnap)、Omnipage——这些一定是人类已知的一些最糟糕的编程软件。如果您能找到如何完全自动化(无提示)批量 OCR保存同名PDF,请在此处发帖。似乎我能找到的唯一解决方案在某处失败了——重命名、不完全自动化等。充其量,有一种方法可以做到,但是文档和编程太糟糕了,你永远不会发现。

  • ABBYY FineReader Engine、ABBYY Recognition Server - 这些确实是更多的企业解决方案,您可能最好让 acrobat 运行一个文件夹并尝试清除给您带来错误/崩溃程序的 pdf,而不是经历尝试的麻烦安装评估软件(假设您是一个简单的最终用户)。对于小用户来说似乎没有成本竞争力。

  • ** Autobahn DX 工作站** 这个产品的成本太高了,你大概可以买6个acrobat。不是真正的最终用户解决方案。如果您是企业设置,这对您来说可能是值得的。

Linux

  • WatchOCR – 不再开发,基本上不可能在现代 Ubuntu 发行版上运行
  • pdfsandwich – 不再开发,基本上不可能在现代 Ubuntu 发行版上运行
  • ** ABBY LINUX OCR ** - 这应该是可编写脚本的,并且似乎有一些不错的结果:

http://www.splitbrain.org/blog/2010-06/15-linux_ocr_software_comparison

但是,就像他们按页面收费的许多其他 ABBYY 产品一样,您最好尝试让 Acrobat Batch OCR …

windows linux pdf ocr adobe-acrobat

22
推荐指数
2
解决办法
2万
查看次数

标签 统计

adobe-acrobat ×1

linux ×1

ocr ×1

pdf ×1

windows ×1