【问题标题】:"OCR" characters/short sequences of text/numbers“OCR”字符/文本/数字的短序列
【发布时间】:2015-07-23 07:28:19
【问题描述】:

这是我的问题:我必须从位图中识别数字(例如 853 / 52)和一些文本(包含大约 8 个字母),而且我必须非常快地做到这一点。

Tesseract 可以解决问题,但它的执行时间对我来说有点太慢了。由于我的字符数量有限,而且总是具有相同的字体大小和相同的字体,我想我可以将它们全部提取出来并为一个字符的某些特征建立一个查找表。

然而,要实现这一点,我必须能够将包含 853 的位图“拆分”成单独的字符(就像一些 OCR 培训师那样将它们装箱)。

不幸的是,我不知道如何开始拳击/分离它们。任何建议将不胜感激。

【问题讨论】:

标签: c# ocr pixel


【解决方案1】:

谢谢你的文章。 我解决了一半的问题。如果我使用 Aforge,我可以通过一组过滤器运行它们,在我的情况下,我在灰度和二值化之前增加对比度,然后对它们运行 blob 提取,这样我就可以切碎图片.现在我有了一组干净的字符图像,我将“仅”必须与比较图像进行匹配。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2020-07-14
    • 2010-10-28
    • 2013-04-23
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多