【发布时间】:2014-11-18 04:33:25
【问题描述】:
我正在尝试确定文本行数而不进行 OCR。我想绕过 OCR 并在用户处理太多文本行时给他们一个错误(这将花费太长时间,而且这不是应该给出的那种输入)。理想情况下,我希望在 python 中执行此操作,但如果有任何 c++ 示例可以执行此操作,我可能会对其进行调整。
以下是我可以使用的 API 函数:http://zdenop.github.io/tesseract-doc/group___advanced_a_p_i.html
我可以使用这些函数,但我不知道如何在 python 中处理 BLOCK_LIST、ETEXT_DESC 或 Boxa 对象,除非将它们从一个 API 调用提供给另一个。
任何帮助将不胜感激!
【问题讨论】:
-
这个问题可能太大了...为什么不缩小范围
-
不知道如何缩小范围。我正在寻找的输出是一个数字,即 OCR 图像中的行数。我不知道哪个 API 调用最适合实现这一目标。
-
@gorgonaut 为什么你认为你可以在不进行 OCR 的情况下获得 OCR 图像的线条?您是否尝试过按文件大小确定?
-
GetTextlines 函数说它可以在识别之前运行,所以我希望这会导致在更昂贵的识别函数之前进行页面分割zdenop.github.io/tesseract-doc/…
标签: python c++ ocr tesseract python-tesseract