【发布时间】:2015-07-23 07:28:19
【问题描述】:
这是我的问题:我必须从位图中识别数字(例如 853 / 52)和一些文本(包含大约 8 个字母),而且我必须非常快地做到这一点。
Tesseract 可以解决问题,但它的执行时间对我来说有点太慢了。由于我的字符数量有限,而且总是具有相同的字体大小和相同的字体,我想我可以将它们全部提取出来并为一个字符的某些特征建立一个查找表。
然而,要实现这一点,我必须能够将包含 853 的位图“拆分”成单独的字符(就像一些 OCR 培训师那样将它们装箱)。
不幸的是,我不知道如何开始拳击/分离它们。任何建议将不胜感激。
【问题讨论】:
-
识别模式对人类来说很容易,但对机器来说却不是那么容易。我不确定限制预期的形状是否会提供足够的加速。也许您对此感兴趣:Large pattern recognition system using multi neural networks
-
您能在此处张贴示例图片吗?