【问题标题】:Best OCR For HexdumpsHexdump 的最佳 OCR
【发布时间】:2020-06-28 00:59:23
【问题描述】:

我正在寻找一种可以使用 OCR 可靠地提取图像左侧(非 ascii 字符)的方法。我有许多类似格式的图像,也显示十六进制数据,我想提取它们。

谁能推荐一种从这些图像中提取文本的方法?

理想情况下,第一行的输出是:

0005C850 00 00 00 00 等

第四行的输出类似于:

0005C8AA ED 93 A7 8E 等

【问题讨论】:

  • 您能否详细说明您的问题?上下文是什么?
  • 我喜欢这个问题,但投票结束,因为它似乎在要求工具推荐,这是题外话。
  • 我不会说这显然是题外话。我正在寻找一种能够从这些图像中提取文本的编程方式或工具。
  • github.com/tesseract-ocr/tesseract 用于OCR 完整图像并应用一些条件以仅返回您需要的令牌

标签: ascii ocr xxd


【解决方案1】:

已经编写了一个传奇的程序来执行此操作。 -https://github.com/eighttails/ProgramListOCR。对于 Windows 系统,我在 VM 上运行。

很难找到。

首先您要将图像转换为 400% 的大小:

convert -resize 400% source.png source.png

灰度化:

convert source.png -colorspace Gray destination.png

改成tiff文件:

转换destination.pngdestination.tiff

然后您使用此软件对其进行处理。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2017-07-09
    • 1970-01-01
    • 2012-04-13
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2015-02-13
    相关资源
    最近更新 更多