【发布时间】:2020-06-28 00:59:23
【问题描述】:
我正在寻找一种可以使用 OCR 可靠地提取图像左侧(非 ascii 字符)的方法。我有许多类似格式的图像,也显示十六进制数据,我想提取它们。
理想情况下,第一行的输出是:
0005C850 00 00 00 00 等
第四行的输出类似于:
0005C8AA ED 93 A7 8E 等
【问题讨论】:
-
您能否详细说明您的问题?上下文是什么?
-
我喜欢这个问题,但投票结束,因为它似乎在要求工具推荐,这是题外话。
-
我不会说这显然是题外话。我正在寻找一种能够从这些图像中提取文本的编程方式或工具。
-
将github.com/tesseract-ocr/tesseract 用于OCR 完整图像并应用一些条件以仅返回您需要的令牌